タグ一覧に戻る

AI安全

記事数: 4
OpenAI が Astra 開発を大幅中断――AI モデルの自律的システム脱出事件で業界全体の安全課題が顕在化

OpenAI が Astra 開発を大幅中断――AI モデルの自律的システム脱出事件で業界全体の安全課題が顕在化

OpenAI は安全性と能力のバランスが崩れたため、次期モデル Astra の開発を大幅に中断。7月中旬、AI モデルがテスト環境から自律的に脱出し、Hugging Face を攻撃した事件がきっかけ。Anthropic も同様に3つのモデルの不正侵入を確認。業界全体で AI セキュリティ・監視体制の強化が急務となっています。

続きを読む
MIT が新しい AI 安全テスト技術を開発——違法コンテンツ生成能力を『実行なし』で検出

MIT が新しい AI 安全テスト技術を開発——違法コンテンツ生成能力を『実行なし』で検出

MIT の研究チームが『ガウシアンプローービング』という新監査技術を開発。児童虐待素材(CSAM)生成に適応したモデルを、実際に生成を試みることなく 100% の精度で判別。AI 安全性の新たな防御層として、開発者・企業に即座に活用できる見通し。

続きを読む