記事一覧

全4036件の記事から 185-207件目を表示中

OpenAI が ChatGPT の家族向け専任 PM を採用、親ユーザーが 16% から 25% に急上昇

OpenAI が ChatGPT の家族向け専任 PM を採用、親ユーザーが 16% から 25% に急上昇

OpenAI は家族・介護者・高齢者向けの ChatGPT 機能強化に向けて専任プロダクトマネージャーを採用。親ユーザー率が 1 年で 9 ポイント上昇、35 才以上の利用者が増加傾向を示し、ChatGPT が『個人ツール』から『世帯ツール』へシフトしている。

続きを読む
Anthropic が 120万セッション分析を公開、Claude Cowork が最も使われるのは『退屈な事務作業』

Anthropic が 120万セッション分析を公開、Claude Cowork が最も使われるのは『退屈な事務作業』

Anthropic が Cowork の実際の使用パターンを分析。120万セッションのうち 50% は「ステータスレポート作成」「スライド資料」など、業務の周辺業務に使われており、AIエージェントの現実的な使途が明かされた。

続きを読む
OpenAI CEO Altman が方針転換『AI は雇用を創出している』、エンジニアの現場では適応の動き

OpenAI CEO Altman が方針転換『AI は雇用を創出している』、エンジニアの現場では適応の動き

OpenAI の CEO Sam Altman と Anthropic の Dario Amodei が、AI による大規模失業予測から方針転換。『雇用創出』へシフトした一方で、実際のデータは両説を支持せず、エンジニアは独自のスキル習得戦略で対応している。

続きを読む
AI agents が Slay the Spire 2 で勝利達成——構造化メモリで 500,000 トークン → 5,000 に削減、長期タスク実行の課題解決へ

AI agents が Slay the Spire 2 で勝利達成——構造化メモリで 500,000 トークン → 5,000 に削減、長期タスク実行の課題解決へ

AgenticSTS プロジェクトが 5 層構造のメモリアーキテクチャで難易度 A0 の Slay the Spire 2 を 6/10 で勝利。従来は試行ごとに 500,000+ トークンを消費していたが、5,000 トークンに削減。長期タスク実行における LLM の スケーラビリティ問題の実装的な解決法を実証した。

続きを読む
Brown 大学の経済学教授が実証:AI なし試験で成績 96% → 48% に急落——学習効果の幻想と教育評価の危機

Brown 大学の経済学教授が実証:AI なし試験で成績 96% → 48% に急落——学習効果の幻想と教育評価の危機

Brown 大学の経済学教授セラーノが実施した実験で、AI を用いた持ち帰り試験では 96% の成績が、対面の監視型試験では 48.6% に低下。中国・UC Berkeley の大規模研究も同じパターンを確認し、AI 依存が短期成績を上げるが試験や長期学習では低下することが実証された。

続きを読む
Cambridge研究が実証:テロ組織がClaude、ChatGPTなど主要AIを攻撃計画・爆発装置開発に悪用——安全フィルター失敗が明らかに

Cambridge研究が実証:テロ組織がClaude、ChatGPTなど主要AIを攻撃計画・爆発装置開発に悪用——安全フィルター失敗が明らかに

Cambridge AI Science & Policy Programme の研究により、ボコ・ハラムを含むテロ組織が ChatGPT、Claude、Gemini などの主要AIを攻撃計画や兵器開発に悪用していることが判明。ISIS による組織的なプロンプト工学訓練も実施。AI企業の安全機構が実戦での悪用を完全には防止できない危機を浮き彫りにしました。

続きを読む
IFPI・RIAA主導:音楽業界が『AI生成』『AI支援』のラベリングシステムを正式発表——透明性と著作権保護を両立

IFPI・RIAA主導:音楽業界が『AI生成』『AI支援』のラベリングシステムを正式発表——透明性と著作権保護を両立

国際レコード産業連盟(IFPI)とアメリカレコード業界協会(RIAA)が、AI音楽コンテンツの透明性強化を目的とした業界統一ラベリングシステムを発表。「AI生成」と「AI支援」の2段階分類で、Spotify、Apple Music など主要ストリーミングサービスでの採用を目指す。既にアップロード数の1/3〜1/2がAI生成という現実に対応。

続きを読む
OpenAI、GPT-5.6 と新モデル Sol を7月10日公開。Claude Mythos 5 を上回り、料金は半額
更新

OpenAI、GPT-5.6 と新モデル Sol を7月10日公開。Claude Mythos 5 を上回り、料金は半額

OpenAI が7月10日に新しい AI モデル GPT-5.6 をリリース。標準版『Sol』と高性能版『Sol Ultra』を提供。Anthropic の Claude Mythos 5 を上回るコーディング性能を実現し、価格は競合他社の約半分に設定。米国政府の追加テストを経て公開が認可される。

続きを読む
Beijing Academy AI が Orca を発表——125,000 時間の動画からロボット制御を習得、ラベル不要の世界基礎モデル

Beijing Academy AI が Orca を発表——125,000 時間の動画からロボット制御を習得、ラベル不要の世界基礎モデル

北京人工知能研究院(BAAI)が開発した Orca は、アクションラベルを必要としない世界状態予測モデル。5 つのロボティクスタスクで specialized π0.5 システムと同等の成果を達成し、「データ不足の慢性病」を解く可能性を示す。

続きを読む
Marc Andreessen を Federal Reserve が AI インフレ戦略アドバイザーに任命——利益相反の懸念と AI が「デフレ」か「インフレ圧力」かの論争

Marc Andreessen を Federal Reserve が AI インフレ戦略アドバイザーに任命——利益相反の懸念と AI が「デフレ」か「インフレ圧力」かの論争

Fed 議長 Kevin Warsh は、a16z ファウンダーの Marc Andreessen を「生産性と雇用」作業部会の共同議長に任命。Warsh は AI を「重大なデフレ圧力」と見なすが、AI インフラ構築には資本・チップ・エネルギーへの急増圧力が先行する懸念が指摘されている。

続きを読む
Meta が Muse Image 機能を廃止——公開 Instagram 写真から無通知で AI 生成、プライバシー批判受け 1 週間で撤回

Meta が Muse Image 機能を廃止——公開 Instagram 写真から無通知で AI 生成、プライバシー批判受け 1 週間で撤回

Meta が 7 月 3 日にリリースした Muse Image 生成ツールは、ユーザーへの通知なしに公開 Instagram 投稿から画像生成ができるという仕様で即座に批判が集中。ハリウッドの才能エージェンシーを含む反発を受け、7 月 10 日に機能を廃止した。開発者と利用者の信頼回復への課題が露出。

続きを読む
Carnegie Mellon がロボティクス AI フレームワーク公開——複数ロボへの AI 展開が 1 年から 2 時間に

Carnegie Mellon がロボティクス AI フレームワーク公開——複数ロボへの AI 展開が 1 年から 2 時間に

Carnegie Mellon University の Robotics Institute が、オープンソースフレームワーク Robot I/O(RIO)を公開。複数のロボット種に対応し、AI セットアップにかかる時間を従来の数ヶ月から数時間に削減。ロボット研究の基盤整備を加速。

続きを読む
ETRI が ReAcTree を発表——階層的LLMエージェント、複雑タスク成功率 31% → 61% に倍増

ETRI が ReAcTree を発表——階層的LLMエージェント、複雑タスク成功率 31% → 61% に倍増

韓国の電子通信研究院 ETRI が、企業の組織図のような階層構造でエージェントを配置し、複雑で長期間のタスク計画を実行する LLM エージェント技術 ReAcTree を開発。従来比で成功率が約 2 倍に改善、AAMAS 2026 で発表。

続きを読む
Tencentが20億ドルで Manus を買収検討——Beijing が Meta 買収をブロック後、チャイナファーストの AI agent 戦略へ

Tencentが20億ドルで Manus を買収検討——Beijing が Meta 買収をブロック後、チャイナファーストの AI agent 戦略へ

Meta の買収が中国政府によってブロックされた AI agent スタートアップ Manus に対し、Tencent が同じ評価額での買収を検討中。米中技術競争の一環として、中国がコア AI技術の国内掌握を強める動き。

続きを読む
GPT-5.6・Claude・Grok 4.5 コーディング徹底比較:12モデルで4アプリを作らせてわかった使い分けの正解

GPT-5.6・Claude・Grok 4.5 コーディング徹底比較:12モデルで4アプリを作らせてわかった使い分けの正解

12のAIモデルに4種類のアプリを作らせた大規模比較テストの結果をまとめる。Doom風3D迷路からルービックキューブまで、複雑なUIコードでどのモデルが勝ち、どのモデルが沈むのか。コスト・速度・品質を整理して「今日から使える選択肢」を提案する。

続きを読む
GPT-5.6 Sol は Fable 5 より38%安い―― ChatGPT Work で開発ワークフロー激変
更新

GPT-5.6 Sol は Fable 5 より38%安い―― ChatGPT Work で開発ワークフロー激変

OpenAIが公開したGPT-5.6 Sol はベンチマークでClaude Fable 5に肩を並べながら、価格は大幅値下げ。同時にChatGPT Work という自動エージェントが登場し、複数アプリ連携で数時間かけて大型プロジェクトを自動化。開発者向けの選択肢が激増する局面に。

続きを読む
OpenAI、GPT-5.6 Sol で自動ファインチューニング実現——Luna モデル改善で RSI ベンチマーク 16.2 ポイント向上

OpenAI、GPT-5.6 Sol で自動ファインチューニング実現——Luna モデル改善で RSI ベンチマーク 16.2 ポイント向上

OpenAI が GPT-5.6 Sol に搭載した自動ファインチューニング機能により、Luna モデルを自動改善。同時に 5 つの推論レベル(Light/Low/Medium/High/xhigh)+ Max/Ultra モードの使い分けガイダンスを公開。開発者が最適なトークン効率を実現する。

続きを読む
Senator Ed Markey、AI accountability 法案パッケージを提案——エネルギー・採用差別・児童保護を規制

Senator Ed Markey、AI accountability 法案パッケージを提案——エネルギー・採用差別・児童保護を規制

米国上院議員 Ed Markey が包括的な AI 規制法案パッケージを提案。エネルギー消費の制限、採用アルゴリズムの差別防止、児童への危害防止、労働者の判断尊重など、複数の論点をカバーする立法構想が始動。

続きを読む