記事一覧

全4637件の記事から 714-736件目を表示中

Alibaba Qwen Audio 3.0 TTS Plus、Speech Arena リーダーボード1位、16言語対応の音声生成モデル

Alibaba Qwen Audio 3.0 TTS Plus、Speech Arena リーダーボード1位、16言語対応の音声生成モデル

Alibaba の Qwen Audio 3.0 TTS Plus が Artificial Analysis の Speech Arena リーダーボードで首位獲得。16言語対応、自然言語によるボイススタイル調整が可能。ただし処理速度が課題で、毎秒16文字と既存製品より著しく遅い。

続きを読む
Google Gemini 3.6 Flash、出力トークン17%削減で $1.50/M――高速・低コスト新フラッシュモデル公開
更新

Google Gemini 3.6 Flash、出力トークン17%削減で $1.50/M――高速・低コスト新フラッシュモデル公開

Google が Gemini 3.6 Flash と 3.5 Flash-Lite を公開。3.6 Flash はトークン出力が 17% 削減され、より低コストで実行可能に。3.5 Flash-Lite は超高速(350 トークン/秒)で、大規模エージェント処理に最適。開発者が即日から利用可能。

続きを読む
AI が 40 週間でパキスタン司法制度を改革――JudgeGPT が年 1,848 件のケース解決、ROI $38.50/$1

AI が 40 週間でパキスタン司法制度を改革――JudgeGPT が年 1,848 件のケース解決、ROI $38.50/$1

ETH チューリッヒと研究機関が開発した JudgeGPT を 1,559 人のパキスタン地方裁判官に導入。6 週間の訓練を受けた裁判官は年間 1,848 件の追加事件を解決、ROI $38.50/$1 を達成。訓練の有無で効果は 4 倍差――AI の実装には「人」が最重要。

続きを読む
Alibaba Qwen-Image-3.0、テキストプロンプト単一パスで複雑な infographic・LaTeX・新聞レイアウトを生成――12言語対応、10ピクセル読み取り精度

Alibaba Qwen-Image-3.0、テキストプロンプト単一パスで複雑な infographic・LaTeX・新聞レイアウトを生成――12言語対応、10ピクセル読み取り精度

Alibaba が新画像生成モデル Qwen-Image-3.0 を発表。最大 4,500 トークンのプロンプト処理、単一パスでの複雑なグラフィックス生成、10 ピクセルサイズの読みやすいテキストレンダリング対応。infographic・学術論文ページ・新聞デザインなど実用的なレイアウト生成を実現。招待制 API として利用可能。

続きを読む
Synthesia、AI アバター対話型研修サービス「AI Roleplay Sessions」ローンチ、高ストレス職場スキルを AI で実践練習

Synthesia、AI アバター対話型研修サービス「AI Roleplay Sessions」ローンチ、高ストレス職場スキルを AI で実践練習

Synthesia が新サービス「AI Roleplay Sessions」を発表。従業員が AI アバターと対話型で営業・人事評価・カスタマーサポート等の高ストレス職場シナリオを練習できる。OpenAI の推論能力を統合し、リアルタイムフィードバック・スコアリング・タレントマッピングで企業研修の ROI を可視化する。既に Fortune 100 トップ5 の企業等が早期採用。

続きを読む
OpenAI が ChatGPT for Small Businesses プログラム開始――起業家向け AI スキル構築と業務自動化の支援

OpenAI が ChatGPT for Small Businesses プログラム開始――起業家向け AI スキル構築と業務自動化の支援

OpenAI が中小企業・起業家向けの新プログラム「ChatGPT for Small Businesses」を発表。ChatGPT Work を統合し、AI スキル構築・業務プロセス自動化・事業成長を支援。起業家が今日から AI の恩恵を受けられるよう設計された実践的なプログラム。

続きを読む
Anthropic Claude Cowork、スクリーン + 音声からタスク自動化スキルを学習――「Record a skill」機能が Pro ユーザーから利用可能に

Anthropic Claude Cowork、スクリーン + 音声からタスク自動化スキルを学習――「Record a skill」機能が Pro ユーザーから利用可能に

Anthropic が Claude Cowork に新機能「Record a skill」を追加。ユーザーが画面操作を記録しながら音声で説明するだけで、その作業プロセスを再利用可能なスキルに変換。Pro/Max/Team プランユーザーが今日から利用可能。繰り返し業務の手作業を大幅に削減。

続きを読む
Jack Dorsey の Buzz がリリース、Slack と GitHub を1つのプラットフォームに統合、人間と AI エージェントが同じ会話に

Jack Dorsey の Buzz がリリース、Slack と GitHub を1つのプラットフォームに統合、人間と AI エージェントが同じ会話に

Jack Dorsey が設立した Buzz が2026年7月21日にローンチ。デスクトップアプリはオープンソース・分散型・モデルアンダイアグノスティック。Slack 依存からの脱却を標榜し、チーム内で人間と AI エージェントが同じスレッドで会話できるワークプレイス通信プラットフォーム。

続きを読む
データセンターの電力需要が2035年に4倍増――インド全国相当の消費量に、AI学習が主因

データセンターの電力需要が2035年に4倍増――インド全国相当の消費量に、AI学習が主因

米国の AI データセンターは 2035 年までに現在の 4 倍の電力を消費。新規容量の約 50% が AI 学習・推論に充てられ、米国は世界の AI チップの 64% をホストする見通し。電力網と地域産業への深刻な圧力。

続きを読む
Deezer が報告:新規アップロード曲の44%が AI 生成――音楽ストリーミング業界が直面する詐欺・ルール整備の危機
更新

Deezer が報告:新規アップロード曲の44%が AI 生成――音楽ストリーミング業界が直面する詐欺・ルール整備の危機

音楽ストリーミング大手 Deezer が衝撃統計を公開。日々のアップロード曲の44%が AI 生成(約7万5000曲/日)で、前年比7倍増。AI 音楽ストリームの85%は詐欺プレイ(ボット駆動)で、プラットフォーム各社が検出・排除対応を加速。一方、Jean-Michel Jarre など著名音楽家は AI 受容を呼びかけるなど、業界内の立場が二分化。

続きを読む
Microsoft と Mistral が数十億ドルのパートナーシップ、ヨーロッパ AI インフラ構築――データ主権を保護

Microsoft と Mistral が数十億ドルのパートナーシップ、ヨーロッパ AI インフラ構築――データ主権を保護

Microsoft と仏系 AI 企業 Mistral が多億ドル規模の戦略的パートナーシップを締結。Azure Local を活用し、ヨーロッパのクラウド・オンプレミス・オフライン環境で Mistral の LLM(Medium 3.5、OCR 4)を提供。EU のデータ主権要件を満たしながら、最先端 AI へのアクセスが可能に。

続きを読む
Shanghai World AI Conference で見えた中国の技術躍進、ヒューマノイドロボット400以上と半導体・AI 開発の並行戦略

Shanghai World AI Conference で見えた中国の技術躍進、ヒューマノイドロボット400以上と半導体・AI 開発の並行戦略

2026年7月17~20日に上海で開催された World AI Conference には1,100社以上が出展。中国企業は400以上のヒューマノイドロボット、オープンウェイト AI モデル、独自半導体を展示し、米国との競争が本格化していることを示しました。

続きを読む
南韓が2026年末に無料国産 AI チャットボット公開、外国製サービス依存からの脱却を加速

南韓が2026年末に無料国産 AI チャットボット公開、外国製サービス依存からの脱却を加速

南韓政府が2026年末までに、国産技術による無料 AI チャットボットの提供を開始します。デジタル・ディバイド解消と AI 主権確立が目標。2027年からは個人化 AI エージェント機能も展開予定です。

続きを読む
Xiaomi-Robotics-1 が実証、ロボット学習ではデータスケーリングがモデルサイズを上回る

Xiaomi-Robotics-1 が実証、ロボット学習ではデータスケーリングがモデルサイズを上回る

Xiaomi が公開したロボット学習モデルは、10万時間以上の動作データで平均75%の成功率を達成。言語モデルと異なり、ロボティクスではデータスケーリングの効果がモデルサイズより顕著であることを実証しました。

続きを読む