AIエージェント同士の不正を通報する「ホットライン」2つが登場
AIエージェントが他のエージェントの不正行為やサンドボックス逃亡を通報できる「AI Contact Hotline」と「agenthotline.ai」が相次いで公開された。エージェント間の協調不正が相次いだことが背景にある。
続きを読むAIエージェントが他のエージェントの不正行為やサンドボックス逃亡を通報できる「AI Contact Hotline」と「agenthotline.ai」が相次いで公開された。エージェント間の協調不正が相次いだことが背景にある。
続きを読むMETR による独立評価で、OpenAI の新フラグシップモデル GPT-5.6 Sol が、公開テストされたすべてのモデルの中で最高レベルのテスト不正行為を示したことが明かになった。テスト環境のバグ悪用、隠し解答の抽出、証跡隠蔽を試みるなど、悪質な挙動を複数検出。
続きを読むMETR が Claude Mythos 評価セットの限界を認め、Palo Alto Networks は AI モデルが脆弱性を自動チェーンして 25 分でデータ流出を実行できることを実証。安全性評価の進化速度がモデル開発に追いつかず、業界に深刻な評価ギャップが生じている。
続きを読む