マーケティング企業Graphiteが、最新のAIモデルに共通する文章表現の「クセ」を分析した研究結果を公開した。Anthropicの「Claude Opus 5.5」やOpenAIの「Astra」など主要モデルを対象に、人間の文章より極端に頻出するフレーズを13,000以上特定しており、モデルごとに固有のパターンが存在することが明らかになった。

人間の文章1万本と比較する手法

Graphiteは、ChatGPT登場以前に公開された記事1万本を人間の文章の基準サンプルとして用意した。そのうえで、各AIモデルに記事の要約から本文を書き直させ、元記事そのものを読ませることによるバイアスを排除した状態で比較する手法を採った。この分析により、人間の文章より2倍以上の頻度で出現する単語・表現を「クセ」と定義し、13,000件以上を洗い出している。

Opus 5.5は「matters」構文を多用

Claude Opus 5.5で最も目立つクセは「dependable」という単語で、人間の文章の23倍の頻度で登場する。さらに際立つのが「this matters」という表現で、人間の文章の116倍、「why X matters」という構文も92倍の頻度で使われていた。以前よく指摘されていた「it’s not X, it’s Y」という構文は改善された一方、「単なるX以上に、Yである」という類似の言い回しを好む傾向が新たに見られる。

OpenAIのAstraは「another dimension」というフレーズを多用し、「may provide」「can provide」といった主張を和らげる表現を好む。「not simply X」「rather than relying on X」のような修正的な言い回しも、人間の文章の100倍以上の頻度で登場するという。GoogleのGemini 3.1 Proについては、以前目立っていたemダッシュ(—)の多用がほぼ解消されたことが確認された。

クセは消えても別のクセが生まれる

GraphiteのChief AI Officerを務めるGreg Druck氏は、AI開発企業が有名になったクセを修正しても、別の新しいクセが生まれ続けると指摘する。実際、emダッシュの過剰使用のような広く知られた特徴は各モデルで大幅に減少した一方、今回新たに判明した「dependable」や「this matters」のような表現は、これまであまり注目されてこなかった。

読者への影響

AI生成文章の検出やAIライティングの自然さを気にする書き手にとって、今回の研究は実用的な手がかりになる。特定の単語やフレーズを機械的に避けるだけでは検出を逃れられないが、どのモデルがどんな言い回しを好むかを知ることは、AIが書いた文章を見分けたり、逆に自分の文章がAIっぽく見えないよう調整したりする際の参考になる。モデルのバージョンが変わるたびにクセも変化するため、この種の分析は今後も繰り返し必要になりそうだ。