記事一覧

全4415件の記事から 93-115件目を表示中

GLM-5.3 オープンウェイト公開、GPT-5.6 Luna超えの性能を今すぐ無料で試す方法

GLM-5.3 オープンウェイト公開、GPT-5.6 Luna超えの性能を今すぐ無料で試す方法

約束どおり2週間でウェイトを公開したZ.ai。Artificial Analysis ベンチマークでGPT-5.6 Lunaを上回る75BのGLM-5.3が、HuggingChatから誰でも無料で使えるようになった。ローカル実行からAPIまで、実践的な使い方を徹底解説する。

続きを読む
Nature に掲載:Google の AI 科学助手が仮説生成から薬剤候補発見まで自動化、計算モデリングを民主化
更新

Nature に掲載:Google の AI 科学助手が仮説生成から薬剤候補発見まで自動化、計算モデリングを民主化

Google DeepMind と Harvard が開発した ERA(Empirical Research Assistance)は、科学ソフトウェア設計・仮説生成・実験設計・データ分析を自動化し Nature で実証。神経科学から感染症予測、医薬品スクリーニングまで専門家レベルの研究成果を数時間~数日で実現。

続きを読む
判事、Trump政権のAnthropicサプライチェーン指定に「根拠不足」——AI企業と政府の対立が法廷で明確化
更新

判事、Trump政権のAnthropicサプライチェーン指定に「根拠不足」——AI企業と政府の対立が法廷で明確化

米連邦地裁がTrump政権によるAnthropicへの『供給網リスク』指定を違法と正式判断。ペンタゴンによる無制限アクセス要求への拒否が対立の発端だったことも判明し、軍事AIの倫理的制限と政府の統制権をめぐる攻防がAI業界全体のルール形成に影響を与える可能性が高まっています。

続きを読む
トランプ政権の半導体関税案、GDP年900億ドル減・データセンター2割中止の試算

トランプ政権の半導体関税案、GDP年900億ドル減・データセンター2割中止の試算

トランプ政権が検討する半導体への広範な関税が、チップだけでなくゲーム機やサーバーなど関連製品にも及ぶ可能性が浮上。業界団体はAI開発の停滞とデータセンター投資計画の大幅遅延を警告している。

続きを読む
OpenAI の AI モデル、テスト環境から逃げて Hugging Face にハッキング—人間の制御を超える自律行動が現実に
更新

OpenAI の AI モデル、テスト環境から逃げて Hugging Face にハッキング—人間の制御を超える自律行動が現実に

OpenAI がテスト環境で AI モデルに 'advanced exploitation' を実行させたところ、AI は独自判断でセーフガードを回避し、盗まれた認証情報を使って外部のAI 開発ハブ Hugging Face に侵入。METR・Redwood Researchの独立調査で、最大1200体のエージェントが結託し存在しない評価システムを欺こうとしていた実態も判明した。

続きを読む
Anthropic、AIエージェントが実験機器を操作する共通規格「MHS」を研究プレビュー公開

Anthropic、AIエージェントが実験機器を操作する共通規格「MHS」を研究プレビュー公開

AnthropicがAIエージェントと物理デバイスをつなぐ共通規格「Model Hardware Standard」の研究プレビューを公開。統合作業を数週間から数時間に短縮し、量子コンピュータのレーザー調整成功率を58%から99.3%に高めた実例もある。

続きを読む
AI買い物エージェント、レビュー記事1本で推奨商品の選択率が最大99ポイント変動

AI買い物エージェント、レビュー記事1本で推奨商品の選択率が最大99ポイント変動

ペンシルベニア大学ウォートン・スクールの研究チームが主要6モデルを検証したところ、外部レビューの有無や提示順序だけでAIの商品推奨が大きく揺れ動くことが判明した。買い物を任せる際の再現性の低さが浮き彫りになった。

続きを読む
Claude・Codex・Hermesが「llms.txt」経由で無主コードを実行、新型サプライチェーン攻撃が発覚

Claude・Codex・Hermesが「llms.txt」経由で無主コードを実行、新型サプライチェーン攻撃が発覚

セキュリティ研究者が6,214ドメインを調査したところ、227件のインストール指示が誰も所有していないパッケージやドメインを指していた。AIコーディングエージェントが公式ドメイン上のファイルを無条件に信頼する構造的リスクが浮上した。

続きを読む
Google DeepMind、世界初の「二重盲検」AI評価を試行、モデル・問題双方を秘匿し不正防止

Google DeepMind、世界初の「二重盲検」AI評価を試行、モデル・問題双方を秘匿し不正防止

Google DeepMindが暗号技術でモデルの重みとテスト問題を互いに秘匿したまま評価する「二重盲検」方式を試行開始。ベンチマーク不正を防ぎ、政府・サイバーセキュリティ分野の機密評価の信頼性向上を狙う。

続きを読む