Xiaomiの新型モデル「MiMo-V2.6-Pro」が、AI分析企業Artificial Analysisのオープンモデルランキングで首位に立った。インテリジェンスインデックススコアは46ポイントで、中国勢のKimiやQwenを上回る結果となった。同時に、Anthropicはこの成果の背後でXiaomiがClaudeの機能を不正に抽出していた疑いがあると指摘しており、両社の対立が浮き彫りになっている。

価格と性能を両立するモデル設計

MiMo-V2.6-Proは1.02兆パラメータを持つMixture-of-Expertsモデルで、実際のリクエスト処理では420億パラメータのみが活性化する仕組みだ。この設計により、入力トークンあたり0.435ドル、出力トークンあたり0.87ドルという価格を実現し、単一のテストタスクはわずか0.13ドルで実行できる。Artificial Analysisはこの水準を「コストと性能のパレート効率フロンティア上に位置する」と評価している。

開発期間は6日未満、コストはPro版が262万ドル、軽量版のFlash版が85万ドルだったという。大規模な強化学習によってコーディング性能も大きく向上し、DeepSWEベンチマークのスコアは58.4から72.6まで上昇した。

Anthropicが指摘する「不正抽出」疑惑

一方でAnthropicは2週間前に公表した脅威インテリジェンスレポートで、Xiaomiを含む中国の7研究機関が合計190万件のやり取りを通じてClaudeから機能を不正に抽出していたと指摘した。具体的には、Xiaomiがユーザーとの会話内容をClaudeに送信し、その応答を訓練データとして利用していた疑いがあるとしている。

これに対しXiaomiは、強化学習ツールキットや技術報告書、約7000個の自動採点タスクを公開するなど、開発プロセスの透明性を積極的に示す姿勢を取っている。性能面での実績と、データ取得手法をめぐる疑惑が同時に浮上した格好だ。

開発者への影響

オープンモデルの選定において、価格性能比は開発者にとって重要な判断材料になる。MiMo-V2.6-Proの低コストは、ローカルLLMや安価なAPIを検討する開発者にとって有力な選択肢となり得る。ただし、Anthropicが指摘する不正抽出疑惑の真偽は今のところ確認されておらず、モデルの評価とデータ取得プロセスの信頼性は分けて見る必要がある。