Anthropicは、Claude 5.5ファミリー第2弾となる中間モデル「Claude Sonnet 5.5」を発表した。出力生成が30%以上高速化し、タスクあたりのコストは最大30%削減されるとしており、知識作業のベンチマークでは上位モデルのOpus 5.5にほぼ並ぶ性能を示している。

コーディング性能が大幅に向上

最も顕著な伸びを見せたのはコーディング関連の指標だ。エージェント型コーディングを測るTerminal-Bench 4.0では、Sonnet 5から10.3%だったスコアが70.6%まで急伸した。実務寄りのコーディングタスクを評価するCursorBench 4.0でも55.5%を記録し、Opus 5.5の57.8%にほぼ匹敵する結果となっている。ドキュメント構造の理解力を測るChartographyも15.6%から61.6%へと大幅に改善した。

知識労働タスクの総合力を示すGDPval-AA v2.1では1,844ポイントを獲得し、Opus 5.5の1,846ポイントとほぼ同水準に達した。Anthropicはエージェンシック・コーディングにおいて、複数エージェントを同時に展開してもコスト制限内に収まりやすくなった点を強みとして挙げている。

価格は据え置き、実効コストを圧縮

トークン単価そのものは変更されておらず、入力は100万トークンあたり2ドル、出力は同10ドル、キャッシュ読み込みは同0.20ドルとSonnet 5と同一だ。その上でタスク完了までに消費するトークン量を減らすことで、実質的なコストを最大30%圧縮した。速度と価格の両面を改善しながら性能を底上げする方向性は、Opus 5.5発表時とも共通する。

セキュリティ面では、Sonnet系として初めてOpus・Fableと同水準のサイバー関連セーフガードが適用された。Anthropicによれば、Opus 5と同等のサイバー能力を備えているという。

Haiku 5.5は数週間以内に登場、GPT-6と直接対抗

Anthropicは、Claude 5.5ファミリー最小モデルとなる「Haiku 5.5」を数週間以内に投入する計画も明らかにした。これが実現すれば、OpenAIのGPT-6系3モデルそれぞれに対応するClaude 5.5モデルが揃うことになる。TechCrunchの報道では、Sonnet 5.5はGPT-6 Lunaより高機能とされる一方、価格はやや高めに設定されている。

開発者にとっては、Opus 5.5に近い性能をより低コストで得られる選択肢が増えたことになる。エージェント型コーディングやドキュメント処理など、これまでOpus 5.5でなければ精度が足りなかった用途の一部が、Sonnet 5.5で代替できるようになる可能性がある。