Google Research、長尺動画研究を公開、AI 動画共同監督と四つのエージェントの枠組み
Google Research は長尺動画生成の研究を公開し、AI 動画共同監督という複数エージェントの編成フレームワークを提案した。Gemini と Veo を基盤に、複数ショットの物語で視覚的一貫性を計画する。
AI による動画の生成と理解:動画生成モデル、動画編集ツール、映像制作の変化を追う。
Google Research は長尺動画生成の研究を公開し、AI 動画共同監督という複数エージェントの編成フレームワークを提案した。Gemini と Veo を基盤に、複数ショットの物語で視覚的一貫性を計画する。
Google DeepMindはGemini 3.8 Live with Live Avatarを公開した。ネイティブなリアルタイム対話モデルにほぼリアルタイムの動画生成を加え、聞く、見る、話すことのできる動的な視覚アバターを実現し、本日からGemini Enterpriseで提供する。
Google DeepMindはGemini 3.7 Flash、3.6 Flash、3.5 Flash-Liteにエージェント型動画理解を導入した。動画分析のトークン消費を最大88%、費用を最大66%削減し、正確さを最大7%高める。
Google DeepMind は Gemini Omni 1.1 Flash を公開した。動画生成の制御性を高め、Google AI Studio の Gemini API から開発者に提供する。
Google DeepMindはNano Banana 2 Lite(gemini-3.1-flash-lite-image)とGemini Omni Flash(gemini-omni-flash-preview)の2モデルを公開した。
Google DeepMind は Gemini Omni シリーズ最初のモデル Gemini Omni Flash を公開した。画像、音声、動画、テキストを組み合わせて高品質の動画を生成し、自然言語の会話で段階的に編集できる。