Gemini Omni
Gemini Omni 是一款由 Gemini 驱动的 AI 视频创作工具,支持从文本、图像、草图或参考素材等任意输入生成高质量视频。现已登陆 Gemini App、Flow 和 YouTube 平台,API 即将开放。
Gemini Omni 是 Google 最新推出的一款 AI 视频创作工具,其核心理念是“从任何输入创造任何输出”,目前以视频生成为起点。用户只需提供一段文字描述、一张图片、一幅草图甚至一段参考视频,Gemini Omni 就能快速生成令人惊叹的视频内容。这一工具融合了 Gemini 强大的推理能力与创造性生成能力,标志着世界理解、多模态处理和视频编辑领域的一次重大飞跃。
Gemini Omni 现已集成到 Gemini App、Flow 和 YouTube 等平台中,用户可以直接在这些平台上体验其功能。此外,开发者很快也将获得 API 访问权限,从而将 Gemini Omni 的能力集成到自己的应用中。在 Product Hunt 上,该产品以“Create anything from any input – starting with video”为口号正式发布,获得了广泛关注。其创始团队形容它“像视频创作界的 Nano Banana——快速、创意十足且极其灵活”。
对于工程师而言,Gemini Omni 可能影响模型选型、推理成本、产品能力以及评测基准。它的出现预示着 AI 视频生成将变得更加平民化,任何人都能凭借一个简单的想法或草图,创作出专业级别的视频内容。