Google、凍結モデルへの複数トークン予測で Pixel の Gemini Nano を高速化
Google Research は、凍結した Gemini Nano v3 に複数トークン予測(MTP)ヘッドを接続する新構造を公開した。本体のウェイトを変えずに端末上の推論を加速し、Pixel 9 と10シリーズで提供済みだ。
モデルを動かすための実践:推論の最適化、メモリとコスト、サービング構成、インフラの選び方。
Google Research は、凍結した Gemini Nano v3 に複数トークン予測(MTP)ヘッドを接続する新構造を公開した。本体のウェイトを変えずに端末上の推論を加速し、Pixel 9 と10シリーズで提供済みだ。
Mistral AIはConnectorsに新機能を追加した。ワークスペース・組織別のアクセス権と個別ツールの有効・無効を設定する管理制御、およびコネクタースコープ付きAPIキーは一般提供となった。
Mistral は OCR 4 を公開した。文字抽出に加え、境界ボックス、ブロック種別、ページ・単語ごとの信頼度を返す。170言語に対応し、単一コンテナで自社運用できる。600超の文書で独立した評価者による盲検評価を行い、平均72%が OCR 4 を好んだとする。OlmOCRBench は85.20、OmniDocBench は93.07だが、両基準の採点方式には既知の限界があると注意する。
Google DeepMindは実験的オープンソースモデルDiffusionGemmaを公開した。テキスト拡散で文章の塊を並列生成し、専用GPUで推論速度を最大4倍に高める。
MistralはAI Now Summit 2026で産業工学向けAIスタックを公開した。Airbus、BMW、ASMLと協力し、独自データと知的財産の管理を維持しながら、設計、シミュレーション、生産を最適化する。
Mistral AI は今週、産業企業の AI 転換支援を強化するため Physics AI の先駆者 Emmi AI を買収する最終契約に署名した。Austria で設立された Emmi AI は30人超の研究者・技術者を擁し、大規模エンジニアリングモデルで数日かかる計算をリアルタイムシミュレーションに置き換え、デジタルツインを構築する。共同創業者とチームは5月に Mistral の Science と Applied AI チームに加わる。
MistralはStudioにConnectorsを公開した。内蔵コネクターと独自MCPをAPI/SDK経由で全モデルとエージェント呼び出しに使える。現在は公開プレビューだ。
Googleはコンテンツの透明性・検証ツールをSearch、Gemini、Chrome、Pixel、Cloudへ拡大すると発表した。SynthIDは1000億超の画像と動画、6万年分の音声に透かしを付けた。Geminiアプリ内のSynthID検証は5000万回利用され、今後数週間でSearchとChromeにも導入される。
Mistral AIはWorkflowsの公開プレビューを開始した。企業AIのオーケストレーション層として、永続実行、可観測性、耐障害性を備え、AIの処理を概念実証から本番へ進める。
Google DeepMind は Decoupled DiLoCo の論文を公開した。大規模訓練を分離した計算の島々に分け、非同期データストリームで通信し、局所的なハードウェア障害を隔離する。
Google Research は TurboQuant を公開した。訓練や微調整なしで、モデル精度を損なわず KV キャッシュを3 bitに量子化できる。QJL と PolarQuant の二手法も提案した。
Google Researchと複数のNHS機関によるAIMS研究は、Nature Cancerに2件の姉妹研究を発表し、NHS乳がん検診の手順におけるAI検出システムの性能を評価した。
Mistral AI は独自知識に基づく最先端級 AI モデル構築システム Forge を公開した。事前訓練、事後訓練、強化学習に対応し、dense と MoE の構造を扱う。必要に応じてマルチモーダル入力にも対応し、企業内の基盤でモデルの訓練とガバナンスを行える。
Mistral AIはMistral OCR 3を公開した。帳票、スキャン、複雑な表、手書き内容でMistral OCR 2に対する全体の勝率は74%で、企業向け文書処理やAIネイティブOCRより高い精度だという。
Mistral は Mistral 3 シリーズを公開した。14B、8B、3B の小型 dense モデルと、過去最強の Mistral Large 3 を含む。後者は稼働41B・総675Bの疎な MoE で、すべて Apache 2.0 で公開する。
Mistralは企業チーム向けの本番用AIプラットフォームMistral AI Studioを公開した。Observability、Agent Runtime、AI Registryの3つを柱とする。
Mistral AIはCodestral 25.08と、Codestral、Codestral Embed、Devstral、Mistral Code IDEプラグインを含む企業向けの完全なコーディングスタックを公開した。
Mistral AIはGPU、編成、API、製品、サービスを含むプライベートな統合AI基盤Mistral Computeを公開した。ベアメタルサーバーからフルマネージドPaaSまで提供する。
MistralはCodestral、Codestral Embed、Devstral、Mistral Mediumの4モデルを統合したAIコーディング助手Mistral Codeを公開した。クラウド、専用容量、ローカルのエアギャップGPUへ配置でき、コードは企業の境界内に留まる。
Mistral AIは初のコード向け埋め込みモデルCodestral Embedを公開した。実際のコード検索でVoyage Code 3、Cohere Embed v4.0、OpenAIの大型埋め込みモデルを上回る。