Google、凍結モデルへの複数トークン予測で Pixel の Gemini Nano を高速化
Google Research は、凍結した Gemini Nano v3 に複数トークン予測(MTP)ヘッドを接続する新構造を公開した。本体のウェイトを変えずに端末上の推論を加速し、Pixel 9 と10シリーズで提供済みだ。
Google と DeepMind の AI の動き:Gemini シリーズ、動画モデル Veo、研究成果とプロダクト群を継続して追う。
Google Research は、凍結した Gemini Nano v3 に複数トークン予測(MTP)ヘッドを接続する新構造を公開した。本体のウェイトを変えずに端末上の推論を加速し、Pixel 9 と10シリーズで提供済みだ。
Google DeepMindはcomputer useをGemini 3.5 Flashの内蔵ツールとして統合した。従来は独立したGemini 2.5 computer useモデルとしてのみ提供していた。
Google DeepMindはGoogle内部で使う高度なAIの構築と管理に向け、AI Control Roadmapを公開した。多層防御の考え方でモデルのアラインメントに加えてシステム単位の安全層を設け、アラインメントが不完全でも保護を提供する。
Google DeepMindは実験的オープンソースモデルDiffusionGemmaを公開した。テキスト拡散で文章の塊を並列生成し、専用GPUで推論速度を最大4倍に高める。
Google DeepMind は Gemini 3.5 Live Translate を公開した。70超の言語に対応するほぼリアルタイムの音声対音声翻訳モデルで、言語を自動検出し、話者の抑揚、リズム、声の高さを保つ。
Google DeepMindはノートパソコンでのローカル実行向けマルチモーダルモデルGemma 4 12Bを公開した。エッジ向けE4Bと26B MoEの中間に位置し、エンコーダーを使わない統一構造で、視覚・音声入力をLLMの本体へ直接渡す。
Google DeepMindはシエラレオネの事前登録済み無作為化比較試験の結果を公開した。8週間の試験でGuided Learning利用者の数学成績が対照群より0.258標準偏差高まり、通常の学習1.2~1.7年分に相当した。
Google は Gemini Enterprise Agent Platform で Agentic RAG による複数コーパス検索の公開プレビューを始めた。Orchestrator、Planner、Query Rewriter、Search Fanout、Sufficient Context Agent などが協働し、複数情報源をまたぐ多段階クエリーを処理する。
Google ResearchはNatureにPHRMシステムの研究を発表した。顔認証によるロック解除後の数秒間に前面カメラで動画を撮影し、深層学習で心拍数と安静時心拍数をバックグラウンド推定する。
Google Researchは水文モデリング枠組みをGitHubでApache 2.0として公開した。各国の気象・水文機関がAI洪水予測を業務に組み込める。PyTorchを使うPythonパッケージで、LSTMを採用し、Caravanデータで学習・微調整できる。対話型のチュートリアルnotebookと動画も付属する。
GoogleはGeminiで科学コードを作成・最適化する研究ツールEmpirical Research Assistance(ERA)を公開した。関連論文は本日Natureに掲載され、Gemini for Scienceの一部として世界の科学者に提供される。
Google DeepMindは実験的プロトタイプProject GenieにStreet View groundingを導入した。Mapsのピンで米国内の実在地点を選び、スタイルとキャラクターを指定すると、Genieが実写を出発地点の基準にした操作可能な世界を生成する。
Google DeepMind は Gemini Omni シリーズ最初のモデル Gemini Omni Flash を公開した。画像、音声、動画、テキストを組み合わせて高品質の動画を生成し、自然言語の会話で段階的に編集できる。
Google DeepMind は Gemini for Science を公開し、Google Labs に三つの実験ツールを導入した。Co-Scientist に基づく Hypothesis Generation。
Googleはコンテンツの透明性・検証ツールをSearch、Gemini、Chrome、Pixel、Cloudへ拡大すると発表した。SynthIDは1000億超の画像と動画、6万年分の音声に透かしを付けた。Geminiアプリ内のSynthID検証は5000万回利用され、今後数週間でSearchとChromeにも導入される。
Google DeepMindとGoogle ResearchのAI気象モデルWeatherNextは、米国立ハリケーンセンターがハリケーンMelissaのジャマイカへのカテゴリー5での上陸を5日前に80%の確信度で予測するのを支援した。3日前には確信度がほぼ100%となった。
Google DeepMind は Gemini 3.5 シリーズの最初のモデル3.5 Flash を公開した。エージェントとコーディングを重視し、本日から Gemini app、Google Search の AI Mode、Google Antigravity、Gemini API、Gemini Enterprise で提供する。
Google DeepMindはNatureでCo-Scientistの研究を発表した。Geminiを基盤とする複数エージェントのAIシステムで、科学的仮説を繰り返し生成、議論、進化させる。
Google DeepMindはAlphaEvolveの1年間の進展をまとめた。Geminiで動くこのコーディングエージェントは、数学・計算機科学の未解決問題から、ゲノム、電力網、量子物理、AIインフラなどへ活動領域を広げた。
Google DeepMindは医師の臨床的監督の下でAIエージェントが診療を支援するAI co-clinician研究計画を発表した。実際のプライマリーケアの98質問の盲検評価では97件に重大な誤りがなく、医師は既存のエビデンス統合ツールよりその回答を好んだ。140項目の診察技能評価でAIは68項目でプライマリーケア医と同等以上だったが、危険信号の発見と重要な身体診察の指示では専門医が全体として優れていた。