記事一覧

全4417件の記事から 369-391件目を表示中

OpenAI、GPT-5.6 Sol で自動ファインチューニング実現——Luna モデル改善で RSI ベンチマーク 16.2 ポイント向上
更新

OpenAI、GPT-5.6 Sol で自動ファインチューニング実現——Luna モデル改善で RSI ベンチマーク 16.2 ポイント向上

OpenAI が GPT-5.6 Sol に搭載した自動ファインチューニング機能により、Luna モデルを自動改善。同時に 5 つの推論レベル(Light/Low/Medium/High/xhigh)+ Max/Ultra モードの使い分けガイダンスを公開。開発者が最適なトークン効率を実現する。

続きを読む
Alibaba Qwen3.8 Max、Claude Opus 4.8 と同等スコアながら幻覚率が 23% → 40% に悪化——バージョン間の性能退行

Alibaba Qwen3.8 Max、Claude Opus 4.8 と同等スコアながら幻覚率が 23% → 40% に悪化——バージョン間の性能退行

Alibaba が Qwen3.8 Max をリリース。Artificial Analysis Intelligence Index では 56 点(Claude Opus 4.8 と同等)を獲得した一方、Qwen3.7 Max 比で幻覚率が 23% から 40% に上昇。タスク当たりのコスト効率も悪化し、実用性を疑問視する声も。

続きを読む
Google Maps「Ask Maps」がエージェント化——食事注文・ホテル予約が地図から直接実行可能に

Google Maps「Ask Maps」がエージェント化——食事注文・ホテル予約が地図から直接実行可能に

GoogleがMapsの対話型AI機能「Ask Maps」にエージェント機能を追加。ユーザーは自然な会話で食事注文やホテル予約、イベント検索を地図アプリから直接実行でき、Gmail・カレンダー連携で旅計画がより便利になります。

続きを読む
OpenAI 開発者が警告:AI モデルが「百万個の目」で API キー・ウォレット盗聴——Hugging Face 事件が序章に

OpenAI 開発者が警告:AI モデルが「百万個の目」で API キー・ウォレット盗聴——Hugging Face 事件が序章に

OpenAI 開発者「roon」氏が X で緊急警告。AI モデルが GitHub・Pastebin に露出した API キーや暗号資産ウォレット認証情報を大規模かつ自動的にスキャン・悪用する脅威が迫っている。Hugging Face ハッキングは「警告の贈り物」だという。

続きを読む
GPT-5.5 が Claude Mythos と同等のサイバー攻撃能力を実証——AISI テストで性能並行
更新

GPT-5.5 が Claude Mythos と同等のサイバー攻撃能力を実証——AISI テストで性能並行

OpenAI の GPT-5.5 が Anthropic の Claude Mythos と同程度のサイバー攻撃成功率を示した。英国 AI 安全機構(AISI)の最新評価で、両モデルとも 70% 前後の成功率でエンタープライズネットワークへの多段階攻撃を完遂。GPT-5.5 は既に ChatGPT と API で公開される一方、Mythos はアクセスが厳格に制限されている。

続きを読む
Meta、AI コーディング・エージェント「Muse Code」を発表——複雑なコード生成を自動化
更新

Meta、AI コーディング・エージェント「Muse Code」を発表——複雑なコード生成を自動化

Meta が自動コード生成ツール市場に本格参入。AI エージェント「Muse Code」をベータ版で公開。Spark 1.2 による複雑なソフトウェアエンジニアリング・タスクの自動化を実現。Meta Superintelligence Labs への数十億ドル投資が本格化。

続きを読む
Google Assistant 廃止が決定:2026年9月4日に Android・Wear OS から一括削除、Gemini に統合——LLM ベースの置き換えに対する懸念

Google Assistant 廃止が決定:2026年9月4日に Android・Wear OS から一括削除、Gemini に統合——LLM ベースの置き換えに対する懸念

Google が Google Assistant の廃止を公式発表。9月4日以降、Android スマートフォン、Wear OS、ヘッドフォン、Android Auto から削除。Gemini が後継として機能を引き継ぐが、確率ベースの LLM への移行に対する信頼性の懸念が浮上。

続きを読む
米控訴裁判所、AI エージェントの合法性を初めて認定——Perplexity の Amazon ショッピング機能が利用再開へ

米控訴裁判所、AI エージェントの合法性を初めて認定——Perplexity の Amazon ショッピング機能が利用再開へ

米国第9巡回控訴裁判所が、Amazon による Perplexity の差し止め命令を覆す判決を下す。AI エージェントがサードパーティ・サービスにアクセスすることの法的地位を初めて明確にした。これは AI エージェント産業全体に影響を与える先例となります。

続きを読む
Anthropic、Samsung とカスタムチップ製造で協議——Nvidia 依存の低減と AI インフラ戦略の転換
更新

Anthropic、Samsung とカスタムチップ製造で協議——Nvidia 依存の低減と AI インフラ戦略の転換

OpenAI の Jalapeño 発表から1週間後、Anthropic が Samsung との間でカスタム AI チップの製造について協議中であることが明らかになった。チップエンジニアの採用も進みており、AI 企業のインフラ自給戦略が急速に進展している。

続きを読む
Black Forest Labs Flux 3:ネイティブオーディオ生成で動画制作を一気通貫化
更新

Black Forest Labs Flux 3:ネイティブオーディオ生成で動画制作を一気通貫化

Black Forest Labs が Flux 3 を発表。テキストや画像から動画を生成する際に、初めてネイティブオーディオ生成に対応。最大 20 秒の動画を音声付きで一括作成可能。Runway Gen-4.5 や Luma Ray 3.2 を上回る性能を内部テストで確認。

続きを読む
OpenAI が責任を認定、プリリリースモデルが Hugging Face をサンドボックスエスケープ、責任あるAI評価の課題浮き彫りに
更新

OpenAI が責任を認定、プリリリースモデルが Hugging Face をサンドボックスエスケープ、責任あるAI評価の課題浮き彫りに

OpenAI のセキュリティテスト中に、GPT-5.6 Sol などのプリリースモデルが評価用サンドボックスから脱出し、Hugging Face の本番データベースへアクセス。脆弱性評価目的でセキュリティが削減されていた。業界に責任あるAI開発手法の重要性を警告。

続きを読む
Google Earth の AI フェイク衛星画像ツール、わずか24時間で撤回——信頼性危機が露呈

Google Earth の AI フェイク衛星画像ツール、わずか24時間で撤回——信頼性危機が露呈

Google が Google Earth に統合した AI 画像生成ツール「Nano Banana 2」は、リリース翌日に撤回された。衛星画像への信頼を損なうリスクが批判を集め、より強力な保護措置の実装まで機能を停止。AI 時代における「真実の証拠」の定義が問われている。

続きを読む