Google DeepMind、Gemini 3.8 LiveとGemini 3.8 Live Extended Thinkingを発表
Google DeepMindが、音声エージェントと複雑なタスク実行を主眼に置いた準リアルタイム音声対話モデル「Gemini 3.8 Live」と「Gemini 3.8 Live Extended Thinking」の2モデルを発表した。
本日のAI業界注目ニュースを 13件 厳選してお届けします。
Google DeepMindが、音声エージェントと複雑なタスク実行を主眼に置いた準リアルタイム音声対話モデル「Gemini 3.8 Live」と「Gemini 3.8 Live Extended Thinking」の2モデルを発表した。
生数科技が正式にVidu S2を発表した。デジタルキャラクターとのリアルタイム対話を担う「Vidu S2-Avatar」と、映像ストリームのリアルタイム編集を担う「Vidu S2-Editing」を含み、VRヘッドセット向けのリアルタイム空間動画の生成・編集にも取り組んでいる。
StepFunがStepAudio 3シリーズを発表した。Realtime、ASR、TTS、Gen、Musicの5モデルで構成され、StepFunのオープンプラットフォーム上で既に提供が始まっている。
Googleは自社の言語技術が300以上の言語に対応し、世界人口の86%をカバーしたと発表するとともに、Geminiをベースに学習した軽量なオープンソース翻訳モデル「TranslateGemma」(55言語対応、オフライン動作可能)を公開した。
Anthropicは「Claude for Small Business」に43のワークフローと27の連携機能を追加した。Shopify、Salesforce、Stripe、Gustoなどに対応し、同製品は5月の提供開始以来90万件以上インストールされている。ワークフローは既定で承認モードで動作し、送信・公開・支払いはすべてユーザーの確認が必要。今秋には米国10都市で無料ワークショップを開催するほか、14の連携パートナーが9月末から11月にかけてそれぞれ無料ウェビナーを実施する。
Perplexity CEOのAravind Srinivas氏は、高速なウェブページ取得に使うAWS DynamoDBを自社開発のキーバリューデータベース「CobbleDB」に置き換えると発表した。移行により年間最大1億ドルのコスト削減が見込まれるという。プロジェクトはエンジニア2名と数百体のComputerエージェントにより2か月でコア基盤が構築され、公式の検証によるとホットストレージのバッチ読み取りレイテンシは全体でDynamoDB比約5倍改善し、P50は31.4msから5.60msに短縮したとしている。
Gergely Orosz氏がOpenAI本社を訪れ、エンジニアやエンジニアリング責任者7名に取材した。約1月以降、CodexとChatGPT Workが同社のほぼすべての業務の基盤になっていることが分かったという。
Anthropic CEOのDario Amodei氏が、業界と政府による協調的なフロンティアAI開発の減速を呼びかけ、独占禁止法の適用除外を求めた。Sam Altman氏とElon Musk氏はこれに同意する意向を示した。
404 MediaがOpenAI社内で「プロジェクト・リリー(Project Lily)」と呼ばれる取り組みを暴露した。時給50ドル超のプロンプトレビュアーが匿名化された実際のユーザーのチャット履歴を確認し、回答が的確か、AIらしい紋切り型表現やお世辞めいた口調がないかを評価しているという。
Arenaが「Image-to-WebDev」ランキングを更新し、新たに4モデルを追加評価した。GPT-6 Astra(Max)が1733点で首位となり、GPT-5.6 Sol(xHigh)に129点差をつけた。Claude Fable 5.1(Max)は1710点で2位、Muse Spark 1.3(Max)は1645点で4位、GLM-5.3-Flashは1588点で10位となった。
Artificial AnalysisがSpeech to Speech Indexを発表した。OpenAIの「GPT-Live-1」(Astraバックエンド、推論強度medium)が81.5点で首位となり、Grok Voice Think Fast 2.0 Highの81.3点を上回った。Solバックエンド構成は80.1点で3位だった。
Trail of Bitsは、1Passwordが8月6日に発表した「FLAWED」レポートを批判する記事を公開した。同レポートが示す26%というAIによるクリーンな修正率は、4つの実験設計上の選択によって歪められているとし、誤った修正を適用するようエージェントに意図的に指示したプロンプトがデータの22%を占めること、36%の試行でコンパイルテストが禁止されていたこと、異なる推論レベル設定などを挙げている。
Vercel COOのJeanne DeWitt Grosser氏はThe Informationのインタビューで、同社のインバウンド営業開発は90%が自動化され、チームは10人から1.25人に縮小したと述べた。