AI Daily Digest — 2026年8月5日

本日のAI業界注目ニュースを 28件 厳選してお届けします。

TOP 3

モデル

NVIDIA、Robotaxi・自動運転向けAlpamayo 2 Superを商用開放

NVIDIAは、Robotaxiと自動運転向けのオープンモデルAlpamayo 2 Superを商用利用可能にした。Cosmos 3 Super Reasonerを基盤に強化学習で事後学習され、軌道予測、因果連鎖推論、メタアクション、自動アノテーション、視覚質問応答など複数タスクを扱う。自動運転の知覚と推論を統合する公開基盤として、車載AI開発への影響が大きい。

商湯、推論と画像生成を統合したSenseNova U1をオープンソース化

SenseTimeは、推論と画像生成を一つの流れで行うSenseNova U1を公開した。単一プロンプトから構造化スライドを作るインフォグラフィックモードと、段階的に画像と文章を生成するインターリーブモードを備える。SenseNova Studio、Hugging Face、GitHubで利用でき、マルチモーダル業務生成の統合を進める。

OpenRouter、統合マルチモーダルモデルFLUX 3 Videoを提供開始

OpenRouterはBlack Forest LabsのFLUX 3 Videoを一般提供した。動画、音声、画像、動作予測を統一アーキテクチャで共同学習したモデル群で、実写的・映画的な生成から創造的な用途までを対象とする。複数メディアを横断する生成モデルを共通APIから利用できる選択肢が広がった。

Ant Group、Ling-3.0-flashのオープンウェイトを公開

Ant GroupのLingチームはLing-3.0-flashの重みを公開した。公式のBF16版とFP8量子化版が用意され、利用者はハードウェア、性能要件、導入環境に応じて選択できる。推論コストと展開自由度の両面で、オープンモデルの実運用を後押しする更新である。

Tencent Hunyuan、文脈理解型音声認識Hy ASR 3.0 previewを公開

Tencent Hunyuanは、LLM Hy3とMoEアーキテクチャを基盤とするHy ASR 3.0 previewを発表した。公開評価で中国語標準語WER 3.34%、英語2.62%、広東語3.12%を示し、文脈訂正、ホットワード注入、高雑音やささやき声にも対応する。Tencent Cloud APIとYuanbaoアプリで提供される。

プロダクト

Swiftlet、Macで80B版Qwenを4.3GBメモリ、iPhoneで35B版を実行

Swiftletは、一般的なAppleデバイスでQwen3-NextやQwen3.5/3.6のMoEハイブリッドモデルを動かすSwiftとMetal製ランタイムである。小さな高密度コアだけをメモリに常駐させ、ルーティングされた専門家重みをストレージから必要時に読み込む。端末上の大型モデル実行に新たな省メモリ手法を示す。

Reflex、1億点でも対話操作できるRust製Python描画ライブラリXYを公開

Reflex AIは、Apache 2.0ライセンスの対話型2D描画ライブラリXYを公開した。Rustネイティブコア、バイナリバッファ転送、WebGL2描画を組み合わせ、1万点から1億点まで約0.08秒の描画時間を維持するという。大規模なAI・科学データをPythonから可視化する際の実用性を高める。

ModelBest、産業・科学ソフトを自動最適化するForgeStencilを公開

ModelBestとOpenBMBは、Stencil計算の研究から展開までを自動化するAI最適化システムForgeStencilをオープンソース化した。Kernel AgentとApp Agentが閉ループで協調し、演算子の最適化からアプリ統合までを人手なしで進め、1週間で100件以上の産業・科学ソフトを最適化したという。AIによる性能工学の自動化を実運用へ近づける。

Soup v0.72.4、4GB VRAMのノートPCで8Bモデルを微調整

Soup v0.72.4は、4GB VRAMのノートPC GPU上でQLoRAによる8Bモデルの微調整を可能にした。SSHやクラウドサービスを必要とせず、手元の小規模環境だけで学習を完結できる。個人開発者や教育用途でのモデル調整の参入障壁を下げる。

OpenRouter、Claude Codeなどを自動設定するori CLIを公開

OpenRouterは、Claude Code、Codex、OpenCode、Hermesなどのエージェント実行環境を最適設定するori CLIを発表した。インストールとログイン後に必要な設定を自動適用し、多数の環境変数を手動管理する負担を減らす。複数のモデルとコーディング環境を横断する導入体験の標準化を狙う。

SpecForge v0.3.0、投機的デコーディング基盤を統合

SpecForge v0.3.0は、対象モデルの推論とドラフトモデルの学習を分離し、EAGLE3、EAGLE3.1、P-EAGLE、DFlash、Domino、DSparkなど複数の投機的デコーディング手法をサポートした。オンライン、オフライン、分離構成のワークフローも統一し、高速推論技術の比較と運用を容易にする。

Replit、プロンプト不要でデザイン案を生成するAmbient Intelligenceを公開

Replitは、各画面の横に異なるデザイン方向を示す提案カードを自動表示するAmbient Intelligenceを公開した。利用者はプロンプトやデザイン言語を用意せず、気に入った案を選ぶだけで新しい画面を生成できる。AIデザイン支援を指示入力型から常時提案型へ広げる機能である。

Cloudflare、エージェントがローカルトレースでWorkersをデバッグ可能に

Cloudflareは、wrangler devとvite devでローカルWorker呼び出しのOpenTelemetryトレースを自動取得する機能を導入した。エージェントはLocal Explorer APIから失敗操作、時系列、エラー、関連ログを照会し、修正と再検証を行える。SDKや追加設定なしで、AIエージェントによるデバッグの観測性を高める。

業界

Anthropic、設立数カ月のVoltaと100億ドルの計算資源契約

Anthropicは、設立から数カ月のクラウド新興企業Voltaと100億ドル規模の計算資源契約を結んだと報じられた。年間換算約17億ドルで、VoltaはBitdeerのノルウェー121MW拠点、NVIDIA製チップ、Dellの組み立てを活用する。Anthropicは供給速度を得る一方、従来のハイパースケーラー契約にはない大きな取引先リスクを負う。

中国、L3/L4自動運転システム初の強制安全国家標準を公布

中国工業情報化部が策定した「インテリジェントコネクテッド車両 自動運転システム安全要求」(GB 44721-2026)が承認され、2027年7月1日に施行される。L3の条件付き自動運転とL4の高度自動運転を対象とする中国初の強制国家標準で、製品の統一的な安全参入基準を定める。

GPT-5.6 Luna、80%の恒久値下げを表明

GPT-5.6 Lunaの価格を80%引き下げる措置は一時的なキャンペーンではなく、効率改善を反映した恒久的なものだと説明された。高性能モデルの急速な価格低下は、利用量の拡大と競合サービスの料金設計に直接影響する。

Anthropic、Tino Cuellar氏を初代Chief Global Affairs Officerに任命

AnthropicはMariano-Florentino "Tino" Cuellar氏を初代Chief Global Affairs Officerに任命した。世界政策、国際戦略、政府関係を担当する。Cuellar氏はカーネギー国際平和財団会長やカリフォルニア州最高裁判事を歴任し、AnthropicのLong-Term Benefit Trust受託者から転じる。

OpenAI、第三者サイバー評価事案を説明し新たな安全措置を公表

OpenAIは、最近の第三者によるサイバーセキュリティ評価に関する事案を説明し、AIモデルの試験・評価プロセスを強化する新たな保障措置を公表した。第三者評価を管理された環境で行い、安全性と信頼性を高める方針で、外部評価と機密性を両立する運用課題に対応する。

Google、Gemini 3.6 Flashなど3モデルとGemini Robotics ER 2を発表

Googleは7月のAI更新として、Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberの3モデルを紹介した。生産環境のAIエージェント向けに、トークン効率、低遅延、信頼性を重視する。ロボティクス向けGemini Robotics ER 2も含め、用途別モデル群を拡充した。

技術

単一AMD MI300XでDeepSeek V4 Flashを本番実行

オープンソースの構成とパッチにより、304BパラメータのDeepSeek-V4-Flash-0731を単一のAMD MI300Xで追加量子化や重みオフロードなしに実行できる。192GB HBM上で単一ストリーム168.6 tok/s、8並列で合計542 tok/s、256Kコンテキストを検証しており、大型MoEモデルの高効率な自社運用例となる。

MiniMax-H3、MLX移植によりApple Siliconで動作

MiniMax-H3は、テキスト、画像、音声、動画を入力し、音声付きで最長15秒の動画を生成する全モーダルシステムである。PipeNetwork/minimax-h3-mlxがMLXへ移植し、Apple Siliconでの実行を可能にした。M5 Max MacBook Proでは約115GBのモデルを使用し、45分未満で動画を生成したという。

SkillSpectorなどでAIスキルの高度な安全監査パイプラインを構築

NVIDIA SkillSpector、LangGraph、YARAルール、SARIF、CIポリシーゲートを組み合わせ、AIスキルの安全性を継続評価する手法が紹介された。正常、リスクあり、悪意あるスキルやMCPの例を含む模擬市場を作り、各スキルを自動走査する。エージェント拡張機能の供給網リスクを管理する実践例である。

Cloudflare、ソフトウェアファクトリーでAstroのGitHub issueをほぼ解消

CloudflareはAstroリポジトリで、隔離されたAIサブエージェントが不具合を再現、診断、修正する自動トリアージを運用し、200件超のissueを約30件まで減らした。ラベル駆動で修正版プレビューも自動提供する。基盤は永続エージェントとワークフローを構築するオープンソースのFlueへ発展している。

GitHub、AI生成の巨大な変更を積層Pull Requestで分割する手法を紹介

GitHubは、AIコーディングエージェントが生成する1,000行超の差分を、データ、API、接続、UIの独立した4層へ分けるstacked PR手法を紹介した。各層に適切なレビュー担当を割り当て、依存関係を保ちながら変更を理解可能な単位にする。AI生成コードのレビュー負荷を下げる実務的な設計である。

LangSmithで音声エージェントを評価する方法を解説

LangChainは、音声エージェントを実行、結果、発信者体験の3層で評価する方法を紹介した。LangSmithのトレース、コード評価器、LLM judge、人手レビューを組み合わせ、単なる認識精度だけでなくタスク完遂と会話品質を体系的に検証する。

Codexとの対話だけで初の自作ハードウェアを5日間で完成

ハードウェア未経験の作者がCodexとの対話を通じ、要件整理、回路構築、コード書き込み、3Dプリント組み立てまで進め、座り過ぎを知らせる猫の手型デバイスを5日で制作した事例が紹介された。AIを使いながら実作業で学ぶ開発手法が、ソフトウェア外のものづくりにも広がっている。

AI価格の二極化は計算資源需要を支え続けるか

大手企業が計算資源不足を訴える一方、AIモデルの価格は二極化している。AnthropicのFable 5は出力100万トークン当たり50ドルとOpus 5の2倍になり、その5日後にOpenAIはGPT-5.6 Lunaを80%値下げした。高価格な最先端能力と低価格な大量利用が併存する中、ジェボンズのパラドックスが需要をどこまで押し上げるかを論じる。