OpenAI、GPT-5.6 と新モデル Sol を7月10日公開。Claude Mythos 5 を上回り、料金は半額
OpenAI が7月10日に新しい AI モデル GPT-5.6 をリリース。標準版『Sol』と高性能版『Sol Ultra』を提供。Anthropic の Claude Mythos 5 を上回るコーディング性能を実現し、価格は競合他社の約半分に設定。米国政府の追加テストを経て公開が認可される。
OpenAI が2026年7月10日(木曜日)に新しい AI モデルシリーズ「GPT-5.6」の公開リリースを実施する。米国政府による追加テストおよび承認を経たこのリリースは、競合他社との性能・価格面での競争に新たな展開をもたらす。
新モデル Sol と Sol Ultra の二層構成
OpenAI は GPT-5.6 の下で2つのバリエーションを提供する。標準版の「Sol」と高性能版の「Sol Ultra」である。この戦略は、ユースケースに応じて顧客が最適なバージョンを選択できる設計になっている。
コーディングベンチマークで Claude Mythos 5 を上回る
性能面での大きな特徴は、TerminalBench 2.1 コーディングベンチマークにおいて、Sol Ultra が 91.9% を記録し、Anthropic の競合モデル Claude Mythos 5 を上回ったという点だ。
さらに興味深いのは、サイバーセキュリティタスクでは競合製品と同等の性能を「使用トークン数を3分の1に削減して実現している」という報道である。これは、単なる性能向上だけでなく、エネルギー効率と運用コストの最適化を同時に達成していることを意味する。
料金設定:競合の約半分
最も開発者・企業にとって意思決定に影響するのは、価格設定である。新モデル Sol の入力トークン・出力トークンあたりの料金は「$5/$30(百万トークン単位)」に設定されている。これは競合他社の約半分という水準だ。
類似の高性能モデル(Claude Mythos 5 など)と比較すると、OpenAI はコスト効率性で大きなアドバンテージを持つ。開発者や企業が採用を検討する際、この価格設定は重要な判断材料となる。
米国政府による承認プロセス
本リリースに至るまでには、米国商務省傘下の AI Standards and Innovation Center による追加テストが実施された。OpenAI は政府による制限を批判していた一方で、公開テストプロセスを経た承認は「政府の信頼」を示すシグナルとなる。
ただし、OpenAI は「開発者へのアクセス制限が続くことを懸念していた」と報道されており、今後の規制環境と企業の開発自由度のバランスは、AI 業界全体の注視点として残る。
読者への影響
一般ユーザー・開発者にとって、GPT-5.6 のリリースは3つの選択肢を明確にする。
- 性能を重視: Sol Ultra での高度なコーディング・複雑な推論タスク
- コスト効率を重視: Sol の安価な価格設定でのスケール運用
- 競合との比較検討: Claude Mythos 5 との性能・価格比較で選択
今後のプロダクト開発やビジネス判断では、「Sol が競合の半額で同等以上の性能」という事実が、採用基準を大きく変える可能性が高い。AI インフラのコスト最適化が進む中、このリリースはエコシステム全体への波及効果をもたらすだろう。
【アップデート】Sol Ultra が 50 年の数学問題を解いた実例が判明
リリース翌日の 7 月 11 日、OpenAI は GPT-5.6 Sol Ultra が実際に Cycle Double Cover Conjecture を 1 時間以内に証明したことが判明した。この問題は 1970 年代から 50 年間未解決のままだった graph theory の難題である。
処理方法と数学的評価
Sol Ultra は 64 個のサブエージェントを並列処理させることで、この証明に至った。Princeton 大学の数学者 Thomas Bloom は、この証明を「短く初等的で、1980 年代に発見できたはずの方法」と評価している。つまり、既存の数学ツールを巧みに組み合わせることで、人間の数学者が見落としていた解法を導き出したという意味だ。
指摘される課題:引用不足
ただし Bloom は重要な指摘をしている。この証明には 1983 年の Bermond・Jackson・Jaeger による基礎研究への言及が不足しており、AI が先行研究を適切に引用・帰属するメカニズムが未成熟である点を浮き彫りにしている。
これは「AI は本当に新しい数学を創造しているのか、それとも既知の知識を巧みに再結合しているだけなのか」という根本的な問いを改めて喚起する。開発者にとって、このニュースは Sol Ultra の汎用的な推論能力を証明する一方で、「AI 生成コンテンツの引用・透明性」という業界全体の課題も浮き彫りにした。