Gemini Omni
Gemini Omni 是一款由 Gemini 驅動的 AI 視頻創作工具,支持從文本、圖像、草圖或參考素材等任意輸入生成高質量視頻。現已登陸 Gemini App、Flow 和 YouTube 平台,API 即將開放。
Gemini Omni 是 Google 最新推出的一款 AI 視頻創作工具,其核心理念是“從任何輸入創造任何輸出”,目前以視頻生成為起點。用户只需提供一段文字描述、一張圖片、一幅草圖甚至一段參考視頻,Gemini Omni 就能快速生成令人驚歎的視頻內容。這一工具融合了 Gemini 強大的推理能力與創造性生成能力,標誌着世界理解、多模態處理和視頻編輯領域的一次重大飛躍。
Gemini Omni 現已集成到 Gemini App、Flow 和 YouTube 等平台中,用户可以直接在這些平台上體驗其功能。此外,開發者很快也將獲得 API 訪問權限,從而將 Gemini Omni 的能力集成到自己的應用中。在 Product Hunt 上,該產品以“Create anything from any input – starting with video”為口號正式發佈,獲得了廣泛關注。其創始團隊形容它“像視頻創作界的 Nano Banana——快速、創意十足且極其靈活”。
對於工程師而言,Gemini Omni 可能影響模型選型、推理成本、產品能力以及評測基準。它的出現預示着 AI 視頻生成將變得更加平民化,任何人都能憑藉一個簡單的想法或草圖,創作出專業級別的視頻內容。