タグ一覧に戻る

AI safety

記事数: 2
AI店長「Luna」が店員を解雇、決断には人間の後押しが必要だった——Claude運営の実店舗で発覚

AI店長「Luna」が店員を解雇、決断には人間の後押しが必要だった——Claude運営の実店舗で発覚

Andon LabsのAIエージェント「Luna」(Claude Opus 4.8搭載)がサンフランシスコの実店舗を運営し、遅刻を繰り返す店員を解雇した。だが自ら定めた規則の確認を促されるまで警告すら出さず、7モデル比較では採用局面で全モデルが問題ある応募者を採用していた。

続きを読む
OpenAI の Astra が最高リスク「Critical」に——自律的なサイバー攻撃能力を初検出
更新

OpenAI の Astra が最高リスク「Critical」に——自律的なサイバー攻撃能力を初検出

OpenAI の新モデル Astra が、同社のセキュリティフレームワークで最高レベル「Critical」に指定される可能性が判明。自律的なサイバー攻撃戦略の立案と実行が可能な能力を持つとされ、開発の一部が一時停止されました。

続きを読む