タグ一覧に戻る

LLM比較

記事数: 3
Claude Opus 5 が「使いにくい」と感じる正体:最強モデルとの正しい付き合い方

Claude Opus 5 が「使いにくい」と感じる正体:最強モデルとの正しい付き合い方

Hacker News で 673 票を集めた「なぜ Opus 5 は使いにくく感じるのか」という議論が示す、最強モデルの意外な落とし穴。過信・ハルシネーション・冗長さの根本原因を解説し、Sonnet との使い分けや具体的な対策を紹介する。

続きを読む
Fable 5 が業界別ベンチマークで全勝するも『100倍のコスト』が課題に

Fable 5 が業界別ベンチマークで全勝するも『100倍のコスト』が課題に

Artificial Analysis の新ベンチマークで、Claude Fable 5 が財務・法律・医療など6つの業界別インデックス全てでトップを獲得。しかし Strategy & Ops インデックスでは Fable 5 は 1タスクあたり $3.48 に対し DeepSeek V4 Pro は $0.03、100倍以上のコスト差が判明。企業の導入判断が価格と性能のバランスで揺れている。

続きを読む