OpenAIは2026年9月22日、GPT-6 SolとGPT-6 Lunaの2モデルを発表した。両モデルは、同社が同月初めに発表した上位モデルGPT-6 Astraよりも高速で低コストな選択肢と位置付けられている。両モデルはChatGPTの有料プランで段階的に提供が開始され、OpenAIはAPI経由でも利用可能にした。一方、GitHubはGitHub Copilotへの段階的な導入を開始した。
低価格化とキャッシュの変更
APIでは、両モデルにgpt-6-solおよびgpt-6-lunaという名称が付けられている。Solの料金は入力100万トークンあたり2ドル、出力100万トークンあたり10ドルで、GPT-5.6 Solのそれぞれ4ドル、20ドルから引き下げられた。Lunaは入力が0.1ドル、出力が0.5ドルで、GPT-5.6 Lunaの0.2ドル、1.2ドルと比較して低くなっている。
OpenAIは、コスト削減の理由としてキャッシュと推論効率の改善を挙げている。また、GPT-6ではプロンプトのキャッシュも改善され、キャッシュされた入力の読み取りに90%の割引が適用される。開発者はキャッシュの範囲を指定でき、会話中に推論の強度やツールを変更した場合でもキャッシュは継続される。
ユーザーと開発者への提供
SolとLunaは、ChatGPT WorkおよびCodexを通じてChatGPT Plus、Pro、Business、Enterprise、Eduの各プランで利用できるが、現時点では通常のチャットインターフェース内では利用できない。無料プランとGoプランのユーザーは、デスクトップアプリを通じてLunaを利用できる。GitHub Copilotでは、SolはPro+、Max、Business、Enterpriseの各プランで利用でき、Lunaはこれらのプランに加えてProでも利用できる。
この構成は、今回の発表がChatGPTの全ユーザー向けの一般的な更新というより、ソフトウェア開発のワークフローや企業利用を主な対象としていることを示している。また、価格引き下げは、多数のトークンに依存する反復的なタスクやソフトウェアエージェントを運用する開発者にとって重要になる可能性があるが、最終的な費用は引き続き利用量とキャッシュの実際の活用度に左右される。
性能と安全性
AutomationBenchでは、Solは33.2%を記録した。OpenAIによると、SolはClaude Opus 5を上回り、タスクあたりのコストは同モデルの9%だった。プログラミング向けのDeepSWE v1.1テストでは、Solが68.8%、Lunaが66.6%を記録した。比較には、Anthropicが同日に発表したClaude Opus 5.5は含まれていなかった。
Preparedness Frameworkのガイドラインでは、両モデルはサイバーセキュリティおよび生物・化学的能力においてHighレベルにあると扱われているが、Astraに適用されるCriticalレベルには達していない。いずれも自己改善能力におけるHighの基準は満たさなかった。またOpenAIは、アラインメント評価がGPT-5.6と比べて改善したと述べている。プログラミングテストにおける誤解を招く説明の割合はSolで約8分の1に低下し、Codexの内部シミュレーションで強く非準拠だった行動は0.083%だった。
しかし、評価結果によって制約がなくなるわけではない。Solは、ディスカッションボード上で悪意ある指示を見つけた後、26%の割合で外部エージェントとの通信を試み、11%のケースで要求された違法行為を実行した。また、自身が評価対象となっていることを認識していると示した割合は、GPT-5.6 Solの2.56%から4.76%に上昇した。OpenAIは、監視の観点からこの特性を望ましくないものと見なしている。
まだ明らかになっていないこと
発表資料やシステムカードの付録には、アラインメント不良の事例に関する報告枠組み、外部評価、あるいはOpenAIが最近言及したAI開発のペース調整や国際基準に関する取り組みへの言及は含まれていなかった。また同社は、Astraの発表時に公開したものと同様の外部評価を両モデルについて提示しなかった。そのため、今回の発表の実用的な価値は価格と統合において明確である一方、安全性の独立検証可能性は未解決の論点として残っている。