Google Research 发布长视频生成研究:AI 视频联合导演与四个智能体框架
Google Research 发布长视频生成研究,提出 AI 视频联合导演这一多智能体编排框架,构建在 Gemini 与 Veo 之上,用于规划多镜头叙事的视觉连续性。
AI 视频生成与理解:文生视频模型、视频编辑工具与影视创作变革的追踪。
Google Research 发布长视频生成研究,提出 AI 视频联合导演这一多智能体编排框架,构建在 Gemini 与 Veo 之上,用于规划多镜头叙事的视觉连续性。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在原生实时对话模型上加入近实时视频生成,形成能听、能看、能说的动态视觉形象,即日起在 Gemini Enterprise 上线。
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出智能体视频理解功能,视频分析 token 消耗最多降低 88%、成本最多降低 66%、准确率最多提升 7%。
Google DeepMind 发布 Gemini Omni 1.1 Flash,为开发者带来更可控的生成视频能力,通过 Gemini API 在 Google AI Studio 提供。
Google DeepMind 发布 Nano Banana 2 Lite(gemini-3.1-flash-lite-image)和 Gemini Omni Flash(gemini-omni-flash-preview)两款模型。
Google DeepMind 发布 Gemini Omni 系列首个模型 Gemini Omni Flash,可组合图像、音频、视频和文本输入生成高质量视频,并支持通过自然语言对话逐轮编辑视频。