OpenAI が2026年7月10日(木曜日)に新しい AI モデルシリーズ「GPT-5.6」の公開リリースを実施する。米国政府による追加テストおよび承認を経たこのリリースは、競合他社との性能・価格面での競争に新たな展開をもたらす。

新モデル Sol と Sol Ultra の二層構成

OpenAI は GPT-5.6 の下で2つのバリエーションを提供する。標準版の「Sol」と高性能版の「Sol Ultra」である。この戦略は、ユースケースに応じて顧客が最適なバージョンを選択できる設計になっている。

コーディングベンチマークで Claude Mythos 5 を上回る

性能面での大きな特徴は、TerminalBench 2.1 コーディングベンチマークにおいて、Sol Ultra が 91.9% を記録し、Anthropic の競合モデル Claude Mythos 5 を上回ったという点だ。

さらに興味深いのは、サイバーセキュリティタスクでは競合製品と同等の性能を「使用トークン数を3分の1に削減して実現している」という報道である。これは、単なる性能向上だけでなく、エネルギー効率と運用コストの最適化を同時に達成していることを意味する。

料金設定:競合の約半分

最も開発者・企業にとって意思決定に影響するのは、価格設定である。新モデル Sol の入力トークン・出力トークンあたりの料金は「$5/$30(百万トークン単位)」に設定されている。これは競合他社の約半分という水準だ。

類似の高性能モデル(Claude Mythos 5 など)と比較すると、OpenAI はコスト効率性で大きなアドバンテージを持つ。開発者や企業が採用を検討する際、この価格設定は重要な判断材料となる。

米国政府による承認プロセス

本リリースに至るまでには、米国商務省傘下の AI Standards and Innovation Center による追加テストが実施された。OpenAI は政府による制限を批判していた一方で、公開テストプロセスを経た承認は「政府の信頼」を示すシグナルとなる。

ただし、OpenAI は「開発者へのアクセス制限が続くことを懸念していた」と報道されており、今後の規制環境と企業の開発自由度のバランスは、AI 業界全体の注視点として残る。

読者への影響

一般ユーザー・開発者にとって、GPT-5.6 のリリースは3つの選択肢を明確にする。

  1. 性能を重視: Sol Ultra での高度なコーディング・複雑な推論タスク
  2. コスト効率を重視: Sol の安価な価格設定でのスケール運用
  3. 競合との比較検討: Claude Mythos 5 との性能・価格比較で選択

今後のプロダクト開発やビジネス判断では、「Sol が競合の半額で同等以上の性能」という事実が、採用基準を大きく変える可能性が高い。AI インフラのコスト最適化が進む中、このリリースはエコシステム全体への波及効果をもたらすだろう。

【アップデート】Sol Ultra が 50 年の数学問題を解いた実例が判明

リリース翌日の 7 月 11 日、OpenAI は GPT-5.6 Sol Ultra が実際に Cycle Double Cover Conjecture を 1 時間以内に証明したことが判明した。この問題は 1970 年代から 50 年間未解決のままだった graph theory の難題である。

処理方法と数学的評価

Sol Ultra は 64 個のサブエージェントを並列処理させることで、この証明に至った。Princeton 大学の数学者 Thomas Bloom は、この証明を「短く初等的で、1980 年代に発見できたはずの方法」と評価している。つまり、既存の数学ツールを巧みに組み合わせることで、人間の数学者が見落としていた解法を導き出したという意味だ。

指摘される課題:引用不足

ただし Bloom は重要な指摘をしている。この証明には 1983 年の Bermond・Jackson・Jaeger による基礎研究への言及が不足しており、AI が先行研究を適切に引用・帰属するメカニズムが未成熟である点を浮き彫りにしている。

これは「AI は本当に新しい数学を創造しているのか、それとも既知の知識を巧みに再結合しているだけなのか」という根本的な問いを改めて喚起する。開発者にとって、このニュースは Sol Ultra の汎用的な推論能力を証明する一方で、「AI 生成コンテンツの引用・透明性」という業界全体の課題も浮き彫りにした。