AI は人間より良い小説を書けるのか? シドニー・シアーズとディーナ・スコルニック・ワイスバーグによる大規模実験は、その問いに複雑な答えを提示しています。

実験の概要

オンライン実験に2,500人以上が参加しました。被験者は複数の短編小説を読み、品質や没入感を5段階で評価しました。ただし、読者は作品が人間による執筆か、AI(ChatGPT 4.0)によるものかを知らされていませんでした。

主要な発見

AI作品が人間作品を上回る

驚くべきことに、作者が不明な状態では、AI 生成短編が人間作品を上回る評価を得ました。

  • 品質スコア: AI 1.54 vs 人間0.97(-3~+3のスケール)
  • 没入感スコア: AI 1.42 vs 人間1.00

しかし、作者判明後は逆転

読者が「これは AI が書いた」と知らされた途端、評価は急落します。肯定的な態度の読者ですら、AI 帰属が判明するとスコアが低下する傾向が見られました。

なぜこうなったのか

実験結果から三つの仮説が浮かびます。

  1. 滑らかさと読みやすさ: AI は統計的に「正統的な」文体を生成するため、読みやすく感じられます。一方、人間の創作、特に短編は意図的に読者に「努力」や「緊張」を要求することがあります。

  2. メタ認知的バイアス: 「これは機械が書いた」という情報が、読者の脳に「創造性がない」という予断を与えます。実際の文質より、属性情報の影響が強いのです。

  3. 創造性への固定観念: 人間は創造性を「人間にしかできない聖なる営為」と考える傾向があり、その枠組みが評価に反映されます。

社会的含意

この研究は、AI の「透明性」がもたらす課題を指摘しています。

  • クリエイティブ産業への影響: AI 生成コンテンツが人間作品と見分けつかない品質に達している可能性を示唆しています。これは著作権や帰属の問題をより複雑にします。

  • 認知バイアスへの対策: 単にAI を排除するのではなく、人間が認知バイアスを自覚し、内容ベースの評価スキルを磨くことの重要性が浮かび上がります。

  • 教育への示唆: 短編形式では AI が有利ですが、長編や複雑な物語構成ではどうか。さらなる研究が必要です。

最後に

「人間にしかできない」という安心感は、多くの仕事や創造活動の現場で共有されていました。この研究は、その前提が「技術的にはもう崩れかけている」ことを示唆しています。今後は、何が人間の価値なのかを問い直す時代へ入るでしょう。