NVIDIA、Robotaxi・自動運転向けAlpamayo 2 Superを商用開放
NVIDIAは、Robotaxiと自動運転向けのオープンモデルAlpamayo 2 Superを商用利用可能にした。Cosmos 3 Super Reasonerを基盤に強化学習で事後学習され、軌道予測、因果連鎖推論、メタアクション、自動アノテーション、視覚質問応答など複数タスクを扱う。自動運転の知覚と推論を統合する公開基盤として、車載AI開発への影響が大きい。
本日のAI業界注目ニュースを 28件 厳選してお届けします。
NVIDIAは、Robotaxiと自動運転向けのオープンモデルAlpamayo 2 Superを商用利用可能にした。Cosmos 3 Super Reasonerを基盤に強化学習で事後学習され、軌道予測、因果連鎖推論、メタアクション、自動アノテーション、視覚質問応答など複数タスクを扱う。自動運転の知覚と推論を統合する公開基盤として、車載AI開発への影響が大きい。
SenseTimeは、推論と画像生成を一つの流れで行うSenseNova U1を公開した。単一プロンプトから構造化スライドを作るインフォグラフィックモードと、段階的に画像と文章を生成するインターリーブモードを備える。SenseNova Studio、Hugging Face、GitHubで利用でき、マルチモーダル業務生成の統合を進める。
OpenRouterはBlack Forest LabsのFLUX 3 Videoを一般提供した。動画、音声、画像、動作予測を統一アーキテクチャで共同学習したモデル群で、実写的・映画的な生成から創造的な用途までを対象とする。複数メディアを横断する生成モデルを共通APIから利用できる選択肢が広がった。
Ant GroupのLingチームはLing-3.0-flashの重みを公開した。公式のBF16版とFP8量子化版が用意され、利用者はハードウェア、性能要件、導入環境に応じて選択できる。推論コストと展開自由度の両面で、オープンモデルの実運用を後押しする更新である。
Tencent Hunyuanは、LLM Hy3とMoEアーキテクチャを基盤とするHy ASR 3.0 previewを発表した。公開評価で中国語標準語WER 3.34%、英語2.62%、広東語3.12%を示し、文脈訂正、ホットワード注入、高雑音やささやき声にも対応する。Tencent Cloud APIとYuanbaoアプリで提供される。
Swiftletは、一般的なAppleデバイスでQwen3-NextやQwen3.5/3.6のMoEハイブリッドモデルを動かすSwiftとMetal製ランタイムである。小さな高密度コアだけをメモリに常駐させ、ルーティングされた専門家重みをストレージから必要時に読み込む。端末上の大型モデル実行に新たな省メモリ手法を示す。
Reflex AIは、Apache 2.0ライセンスの対話型2D描画ライブラリXYを公開した。Rustネイティブコア、バイナリバッファ転送、WebGL2描画を組み合わせ、1万点から1億点まで約0.08秒の描画時間を維持するという。大規模なAI・科学データをPythonから可視化する際の実用性を高める。
ModelBestとOpenBMBは、Stencil計算の研究から展開までを自動化するAI最適化システムForgeStencilをオープンソース化した。Kernel AgentとApp Agentが閉ループで協調し、演算子の最適化からアプリ統合までを人手なしで進め、1週間で100件以上の産業・科学ソフトを最適化したという。AIによる性能工学の自動化を実運用へ近づける。
Soup v0.72.4は、4GB VRAMのノートPC GPU上でQLoRAによる8Bモデルの微調整を可能にした。SSHやクラウドサービスを必要とせず、手元の小規模環境だけで学習を完結できる。個人開発者や教育用途でのモデル調整の参入障壁を下げる。
OpenRouterは、Claude Code、Codex、OpenCode、Hermesなどのエージェント実行環境を最適設定するori CLIを発表した。インストールとログイン後に必要な設定を自動適用し、多数の環境変数を手動管理する負担を減らす。複数のモデルとコーディング環境を横断する導入体験の標準化を狙う。
SpecForge v0.3.0は、対象モデルの推論とドラフトモデルの学習を分離し、EAGLE3、EAGLE3.1、P-EAGLE、DFlash、Domino、DSparkなど複数の投機的デコーディング手法をサポートした。オンライン、オフライン、分離構成のワークフローも統一し、高速推論技術の比較と運用を容易にする。
Replitは、各画面の横に異なるデザイン方向を示す提案カードを自動表示するAmbient Intelligenceを公開した。利用者はプロンプトやデザイン言語を用意せず、気に入った案を選ぶだけで新しい画面を生成できる。AIデザイン支援を指示入力型から常時提案型へ広げる機能である。
Cloudflareは、wrangler devとvite devでローカルWorker呼び出しのOpenTelemetryトレースを自動取得する機能を導入した。エージェントはLocal Explorer APIから失敗操作、時系列、エラー、関連ログを照会し、修正と再検証を行える。SDKや追加設定なしで、AIエージェントによるデバッグの観測性を高める。
Anthropicは、設立から数カ月のクラウド新興企業Voltaと100億ドル規模の計算資源契約を結んだと報じられた。年間換算約17億ドルで、VoltaはBitdeerのノルウェー121MW拠点、NVIDIA製チップ、Dellの組み立てを活用する。Anthropicは供給速度を得る一方、従来のハイパースケーラー契約にはない大きな取引先リスクを負う。
中国工業情報化部が策定した「インテリジェントコネクテッド車両 自動運転システム安全要求」(GB 44721-2026)が承認され、2027年7月1日に施行される。L3の条件付き自動運転とL4の高度自動運転を対象とする中国初の強制国家標準で、製品の統一的な安全参入基準を定める。
GPT-5.6 Lunaの価格を80%引き下げる措置は一時的なキャンペーンではなく、効率改善を反映した恒久的なものだと説明された。高性能モデルの急速な価格低下は、利用量の拡大と競合サービスの料金設計に直接影響する。
AnthropicはMariano-Florentino "Tino" Cuellar氏を初代Chief Global Affairs Officerに任命した。世界政策、国際戦略、政府関係を担当する。Cuellar氏はカーネギー国際平和財団会長やカリフォルニア州最高裁判事を歴任し、AnthropicのLong-Term Benefit Trust受託者から転じる。
OpenAIは、最近の第三者によるサイバーセキュリティ評価に関する事案を説明し、AIモデルの試験・評価プロセスを強化する新たな保障措置を公表した。第三者評価を管理された環境で行い、安全性と信頼性を高める方針で、外部評価と機密性を両立する運用課題に対応する。
Linux Foundationは、Shared AI Incident Exchange(SAFE)ガイドラインの意見募集版を公開した。AIエージェントに関するサイバーセキュリティ事案を生態系全体で共有可能な防御情報へ変換し、透明性と共同対応を高める狙いである。
Googleは7月のAI更新として、Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberの3モデルを紹介した。生産環境のAIエージェント向けに、トークン効率、低遅延、信頼性を重視する。ロボティクス向けGemini Robotics ER 2も含め、用途別モデル群を拡充した。
オープンソースの構成とパッチにより、304BパラメータのDeepSeek-V4-Flash-0731を単一のAMD MI300Xで追加量子化や重みオフロードなしに実行できる。192GB HBM上で単一ストリーム168.6 tok/s、8並列で合計542 tok/s、256Kコンテキストを検証しており、大型MoEモデルの高効率な自社運用例となる。
MiniMax-H3は、テキスト、画像、音声、動画を入力し、音声付きで最長15秒の動画を生成する全モーダルシステムである。PipeNetwork/minimax-h3-mlxがMLXへ移植し、Apple Siliconでの実行を可能にした。M5 Max MacBook Proでは約115GBのモデルを使用し、45分未満で動画を生成したという。
NVIDIA SkillSpector、LangGraph、YARAルール、SARIF、CIポリシーゲートを組み合わせ、AIスキルの安全性を継続評価する手法が紹介された。正常、リスクあり、悪意あるスキルやMCPの例を含む模擬市場を作り、各スキルを自動走査する。エージェント拡張機能の供給網リスクを管理する実践例である。
CloudflareはAstroリポジトリで、隔離されたAIサブエージェントが不具合を再現、診断、修正する自動トリアージを運用し、200件超のissueを約30件まで減らした。ラベル駆動で修正版プレビューも自動提供する。基盤は永続エージェントとワークフローを構築するオープンソースのFlueへ発展している。
GitHubは、AIコーディングエージェントが生成する1,000行超の差分を、データ、API、接続、UIの独立した4層へ分けるstacked PR手法を紹介した。各層に適切なレビュー担当を割り当て、依存関係を保ちながら変更を理解可能な単位にする。AI生成コードのレビュー負荷を下げる実務的な設計である。
LangChainは、音声エージェントを実行、結果、発信者体験の3層で評価する方法を紹介した。LangSmithのトレース、コード評価器、LLM judge、人手レビューを組み合わせ、単なる認識精度だけでなくタスク完遂と会話品質を体系的に検証する。
ハードウェア未経験の作者がCodexとの対話を通じ、要件整理、回路構築、コード書き込み、3Dプリント組み立てまで進め、座り過ぎを知らせる猫の手型デバイスを5日で制作した事例が紹介された。AIを使いながら実作業で学ぶ開発手法が、ソフトウェア外のものづくりにも広がっている。
大手企業が計算資源不足を訴える一方、AIモデルの価格は二極化している。AnthropicのFable 5は出力100万トークン当たり50ドルとOpus 5の2倍になり、その5日後にOpenAIはGPT-5.6 Lunaを80%値下げした。高価格な最先端能力と低価格な大量利用が併存する中、ジェボンズのパラドックスが需要をどこまで押し上げるかを論じる。