Google DeepMind Blog·· 2026-05-18精选AI 评分72
Google DeepMind 发布 Gemini Omni Flash 多模态视频生成模型
Introducing Gemini Omni
AI 导读
Google DeepMind 发布 Gemini Omni Flash,这是 Gemini Omni 系列的首个模型,可将图像、音频、视频和文本组合输入,生成受现实世界知识支持的高质量视频,并支持通过自然语言进行多轮编辑。
推荐理由
Gemini Omni Flash将多模态理解、生成与对话式视频编辑整合,并分阶段进入Gemini app、Google Flow、YouTube Shorts及API;其输入组合、跨轮编辑、角色一致性和SynthID验证机制,对内容创作者与开发者的实际工作流具有直接参考价值。
来源:Google DeepMind Blog · deepmind.google