跳到正文
原文
Google DeepMind Blog·· 2026-05-18精选AI 评分72

Google DeepMind 发布 Gemini Omni Flash 多模态视频生成模型

Introducing Gemini Omni

AI 导读

Google DeepMind 发布 Gemini Omni Flash,这是 Gemini Omni 系列的首个模型,可将图像、音频、视频和文本组合输入,生成受现实世界知识支持的高质量视频,并支持通过自然语言进行多轮编辑。

推荐理由

Gemini Omni Flash将多模态理解、生成与对话式视频编辑整合,并分阶段进入Gemini app、Google Flow、YouTube Shorts及API;其输入组合、跨轮编辑、角色一致性和SynthID验证机制,对内容创作者与开发者的实际工作流具有直接参考价值。

来源:Google DeepMind Blog · deepmind.google