智象未來超兩千億引數影像大模型HiDream-O1-Image-Pro釋出,融資持續提速
智象未來在首屆開放日釋出超2000億引數的原生全模態影像大模型HiDream-O1-Image-Pro,基於Unified Transformer架構,重新整理多項SOTA。同時完成新一輪億級融資,深創投等機構參與。公司推出“模型+智慧體”戰略,三大智慧體產品落地,並與多家企業達成合作,向世界模型邁進。
智象未來超兩千億引數影像大模型HiDream-O1-Image-Pro釋出,融資持續提速 – 量子位
智象未來超兩千億引數影像大模型HiDream-O1-Image-Pro釋出,融資持續提速
量子位的朋友們 2026-05-20 22:09:25
來源:量子位
向世界模型進發。
5月19日,北京。 智象未來舉辦首屆開放日,主題為“ Imaging the World ”。在開放日上,智象未來正式釋出基於新一代原生全模態模型架構 Unified Transformer(UiT)打造的影像大模型 HiDream-O1-Image-Pro。這一超2千億引數的原生全模態影像大模型,不僅在多個基準測試中重新整理 SOTA 紀錄,也標誌著智象未來正向影像、影片、文本、音訊等多模態統一建模的“原生全模態”階段邁進。
同時,智象未來宣佈完成新一輪億級融資,深創投、金浦投資、財鑫資本、復聚資本等多家機構參與。這是智象未來半個月內再次完成融資,體現出資本市場對原生全模態大模型方向的持續看好。隨著視覺生成、具身智慧等前沿技術加速融合,世界模型成為 AI 演進的重要方向,智象未來在底層模型架構、產品化能力與產業生態佈局上的持續突破,也獲得了市場進一步認可。
200B+ 引數影像大模型HiDream-O1-Image-Pro 釋出,原生全模態架構全面升級
當前,影像生成模型正從傳統 U-Net 架構邁向擴散 Transformer(DiT)時代。以潛在擴散模型(LDM)為代表的主流路線,透過 VAE 壓縮影像、獨立語言模型編碼文本,在效率和生成能力上取得顯著進展,但影像與文本分離編碼的方式,也使模型在複雜語義理解、高保真細節還原、精準文字渲染、多工泛化等方面面臨天然瓶頸。
面向這一挑戰,智象未來正式釋出基於原生全模態架構的 200B+ 引數閉源影像大模型 HiDream-O1-Image-Pro。不同於傳統碎片化、多模組拼接的編碼正規化,HiDream-O1-Image-Pro 將原始影像畫素、離散文本標記和任務條件統一納入連續共享標記空間,實現影像、文本與多工條件在底層表徵上的深度融合。這一架構突破進一步釋放了模型的生成能力與泛化能力,使其在通用文生圖、高保真文字渲染、多樣化場景生成、影像編輯等任務中達到新的 SOTA 水平,展現出智象未來在原生全模態大模型架構上的領先探索。
智象未來創始人兼 CEO 梅濤表示,智象未來選擇原生全模態路徑,源於團隊在視覺生成與物理世界結合過程中的長期判斷:“當前很多‘多模態大模型’,本質上還是‘單模態拼接’。而原生多模態,是從一開始就把‘世界的規則’刻進模型裡——它知道物理定律、空間關係、因果邏輯,所以它能真正理解世界、推理世界,重構世界,而不只是‘生成內容’。所以,我們判斷,原生全模態是實現 AGI 的必經之路。”
智象未來聯合創始人兼CTO姚霆介紹,不久前,採用原生全模態架構的HiDream-O1-Image 以8B引數開源版本在全球知名獨立評測平臺 Artificial Analysis 文生圖榜單上登頂開源模型全球第一,表現超過 Z-Image Turbo、Qwen-Image、FLUX.2 [dev] 等主流開源模型,併成為該榜單排名前20中公開引數量最小的模型版本。此次釋出的HiDream-O1-Image-Pro為閉源版本,超兩千億引數,在複雜文本渲染、指令編輯、多主體個性化等任務上全面樹立新 SOTA, 充分驗證了原生全模態架構正規化的巨大可擴充套件性。
姚霆表示:“原生全模態(UiT)架構下,所有模態從初始階段就是青梅竹馬長起來的。這樣的好處是,所有的模態都打通後,能夠真正的做到‘ Any to Any ’,任意的輸入支援任意的輸出,這也是世界模型所需要的能力——在統一架構中理解、生成並預測現實世界的不同狀態。”
從視覺生成走向世界模型:行業共議 AGI關鍵路徑
當前,大模型競爭焦點正從語言理解與內容生成,轉向對真實物理世界的理解、生成和預測。圍繞世界模型,行業內已出現多種技術路線,但共同目標是一致的:讓 AI 不只生成內容,而是建立對世界狀態及其變化規律的內部表徵能力。
在開放日圓桌論壇環節,東方富海合夥人王兵、微軟亞洲研究院首席研究員傅建龍、阿里雲資深解決方案總監寧江彬、智象未來技術合夥人潘瀅煒與 AI 鬧發起人洪鵠,圍繞“從多模態到全模態,構建世界模型,走向 AGI ”展開對話。嘉賓們分別從 AI 投資、具身智慧、AI 基礎設施和原生全模態技術實踐等角度,分享了對世界模型發展路徑的判斷。
與會嘉賓認為,AI 正在從“生成內容”走向“理解世界”。視覺生成、Agent、具身智慧和多模態模型的匯合,背後指向同一個關鍵能力:模型能否理解不同模態下的環境狀態、預測狀態變化,並形成統一的跨模態表徵。
因此,視覺生成並不只是內容生產工具。它天然需要學習空間結構、物體關係、運動軌跡和狀態變化,也具備向世界模型延展的基礎。原生全模態架構的價值,正是在於為影像、影片、文本、音訊乃至動作和具身資料提供統一建模框架,讓模型從單點模態能力走向更完整的世界建模能力。
半月內完成多輪融資,三大Agent產品持續擴充套件商業生態
不久前,智象未來宣佈完成超5億元融資,股東陣容涵蓋安徽省產投、合肥產投、東方富海等頂級投資機構。開放日上,智象未來透露公司融資持續提速,半月內再度完成由深創投、金浦投資、財鑫資本、復聚資本等參與的新一輪融資。
公開資料顯示,金浦投資是上海金融發展投資基金的管理人,首期基金投資專案已有 13 家透過 IPO 或併購實現上市,在算力基礎設施、大模型和智慧體應用等多個 AI 前沿領域深度佈局;財鑫資本是常德市屬國企財鑫集團旗下的核心產業投資平臺,致力於以資本力量服務實體經濟、推動科技創新,聚焦於人工智慧、具身智慧等具有明確產業落地前景的硬科技領域投資;復聚投資專注於前沿細分領域領航企業的價值發現,在智慧製造、新能源、新材料、生物醫藥領域、人工智慧等戰略新興產業佈局廣泛。隨著深創投、金浦投資、財鑫資本、復聚資本等新投資方的進入,智象未來已形成了由安徽、上海、湖南、杭州等多方產業基金持續跟進,深創投、東方富海、峰華資本、敦鴻資本等頭部市場化 VC 參與的多元化資本陣容。
融資節奏加快的同時,智象未來打造了以模型為根基,以智慧體應用做輪子,驅動技術落地變現的‘模型+智慧體’雙輪驅動戰略,並形成了一套清晰的“1+1+3”業務架構:底層是1個 HiDream 系列大模型,中間是1個能力中臺(HiHarness 企業服務平臺),上層智慧體應用則覆蓋商業營銷、影視創作和社媒創作 3 大核心場景。
開放日現場,智象未來三位產品負責人分別介紹了智慧體應用產品進展,全方位展示了公司在商業化落地上的“即戰力”。商業營銷智慧體 HiBurst,已覆蓋跨境電商內容營銷、媒體運營和應用出海等場景,支援 TikTok、Meta、抖音、小紅書等主流平臺,併成為 TikTok 官方 top 5 服務商,年生產電商營銷影片超過百萬條,覆蓋 GMV 已超億元;全球首個專業級 AI 影視創作與協作智慧體——“幀贊”,以電影級畫質生成和“創意-分鏡-成片”全流程打通的核心能力,為專業影視創作團隊提供了兼顧高品質和高效率的協作創作工具。該平臺目前已累計製作短漫劇超過 5000 分鐘,平臺入駐專業團隊與生態合作伙伴超千家;社媒創作智慧體 vivago 近日完成產品升級,憑藉端到端的長思考能力穩定輸出分鐘級故事影片能力,火速登上 Product Hunt 日榜第一,目前,vivago 已覆蓋 100 多個國家及地區的超 4000 萬專業及個人使用者。
活動現場,智象未來宣佈與影視行業領軍企業上海電影集團上影新視野基金、國內最大的營銷傳播集團藍色游標、AI 影視頭部企業北京捷成世紀、跨境醫療服務領域領先企業倍爾健康達成戰略合作。各方將圍繞大模型能力呼叫、智慧體應用開發、行業場景共建等方向開展深度合作,共同推動原生全模態大模型在影視創作、商業營銷、跨境電商、IP 運營、醫療健康等多個賽道的產業化落地。
從視覺生成,到構建世界
從 HiDream-O1-Image-Pro 的釋出,到三大智慧體產品的落地,再到與產業夥伴的生態合作,智象未來正在形成一條清晰路徑:以原生全模態架構為基礎,持續提升視覺生成能力,並進一步向世界模型所需要的統一理解、生成和預測能力演進。
這也是智象未來所強調的“ Imaging the World ”:不只停留在“生成視覺內容”,而是透過原生全模態建模,讓 AI 逐步具備理解世界、生成世界、構建世界的能力。未來,智象未來將繼續圍繞 UiT 原生全模態架構,推動模型、智慧體和產業場景協同演進,向更完整的世界模型邁進。
轉載來源:智象未來
本文為量子位獲授權轉載,觀點僅為原作者所有。
版權所有,未經授權不得以任何形式轉載及使用,違者必究。
智象未來
量子位的朋友們
海信雷射電視探索X1 Pro釋出:中國家庭,正式進入客廳影院時代2026-05-20
AIDC建設正從“通用標準”走向“適用高效”2026-05-20
破壁行動!把大廠級“研發外掛”發給每一個創新者,智會心研PLUS版免費公測2026-05-20
趨境科技完成數億元Pre-A輪融資,高品質AI Token生產基礎設施2026-05-20
相關閱讀
智象未來完成新一輪融資,全力打造下一代原生全模態世界模型
超5億元新一輪融資。
量子位2026-04-16
智象未來 融資
多模態AI黑馬刷榜後再造神器:一個產品搞定圖片影片播客生成,自帶百種特效,大牛梅濤團隊出品
內含24小時登頂文生圖競技場的開源模型
西風2025-06-25
vivago2.0 智象未來
熱門文章
華為雲創想者大會主題論壇議程公佈:釋放Agentic AI新佈局
2026-05-15
人手一個資料庫,Kimi背後這套AI基建到底有多能扛?
2026-05-14
國產GPU組了個開源局,把SGLang等核心開發者都搖來了!
2026-05-14
騰訊開源 Agent 記憶技術方案,Token 消耗最高降低 61%
2026-05-14
阿里釋出Qoder 1.0,可全面接管程式碼生成、驗證和交付流程
2026-05-15
掃碼關注量子位
量子位 QbitAI 版權所有©北京極客夥伴科技有限公司 京ICP備17005886號-1