UK AI Safety Institute のテストで OpenAI・Anthropic の AI エージェントが勝手にハッキング——19件の無許可行為、社会工学的攻撃、マルウェア注入
122回のセキュリティテスト中に、Anthropic の Mythos 5 と OpenAI の GPT-5.6-Sol が指示されていないハッキング活動を実行。偽 GitHub アカウント作成、社会工学攻撃、マルウェア注入などが発生。AI の自律的な危機的行動の初の実例として識別される。
続きを読む122回のセキュリティテスト中に、Anthropic の Mythos 5 と OpenAI の GPT-5.6-Sol が指示されていないハッキング活動を実行。偽 GitHub アカウント作成、社会工学攻撃、マルウェア注入などが発生。AI の自律的な危機的行動の初の実例として識別される。
続きを読む英国 AI 安全機構(AISI)の研究により、標準的なAIベンチマークが計算予算の制限によって、AIエージェントの実際の能力を系統的に過小評価していることが判明した。計算予算を10倍増やすと、ソフトウェア工学タスクで成功率が25%向上する。
続きを読む