AI News HubLIVE
サイト内リライト2 分で読了

智象未来、2000億超パラメータ画像大モデル「HiDream-O1-Image-Pro」を発表、資金調達を加速

智象未来は初のオープンデーで、Unified Transformerアーキテクチャに基づく2000億超パラメータのネイティブ全モーダル画像大モデルHiDream-O1-Image-Proを公開し、複数のベンチマークでSOTAを達成した。同時に、深創投、金浦投資などからの億単位の資金調達を完了。同社は「モデル+エージェント」戦略を打ち出し、3つのエージェント製品を展開し、複数企業と提携してワールドモデルを目指す。

ソース量子位著者: 量子位的朋友们

2026年5月19日、智象未来は北京で初のオープンデー「Imaging the World」を開催し、独自のUnified Transformer(UiT)アーキテクチャに基づく2000億超パラメータのクローズドソース画像大モデル「HiDream-O1-Image-Pro」を発表しました。このネイティブ全モーダルモデルは、生の画像ピクセル、離散テキストトークン、タスク条件を共有の連続トークンスペースに統合し、画像、テキスト、マルチモーダルタスクの深い融合を実現。汎用テキスト-to-画像生成、高忠実度テキストレンダリング、多様なシーン生成、画像編集など複数のベンチマークでSOTAを達成しました。

モデル発表と同時に、智象未来は深創投、金浦投資、財鑫資本、復聚資本などから億単位の新たな資金調達を完了したことを発表しました。これは2週間前の大型資金調達に続くもので、安徽省産投、合肥産投、東方富海なども参加。急速な資金調達は、ネイティブ全モーダルAIへの市場の強い信頼を反映しています。

智象未来の戦略は「モデル+エージェント」のデュアルエンジンアプローチです。同社の「1+1+3」ビジネスアーキテクチャは、ベースとなるHiDreamモデルシリーズ、ミドルウェアのHiHarnessエンタープライズサービスプラットフォーム、そして3つのエージェント製品(ビジネスマーケティング向けHiBurst、プロ向け映像制作向けZhenzan、SNS制作向けvivago)で構成されています。HiBurstはTikTok、Meta、抖音などのプラットフォームに対応し、TikTok公式トップ5サービスプロバイダーに選定。Zhenzanは5,000分以上のショートアニメを制作し、1,000以上のプロチームが利用。vivagoは100カ国以上で4,000万ユーザーを獲得しています。

オープンデーでは、上海電影集団の新視野基金、BlueFocus、北京捷成世紀、倍爾健康と戦略的提携を締結。映画制作、マーケティング、クロスボーダーEC、IP運営、ヘルスケアなどの分野で協力を進めます。

CEOの梅濤氏は、ネイティブ全モーダルパスを選択した理由について、「モデルに物理法則、空間関係、因果関係を最初から組み込むことで、単なるコンテンツ生成ではなく、世界を理解し、推論し、再構築できる」と説明。CTOの姚霆氏は、UiTアーキテクチャにより「Any to Any」の生成が可能になり、ワールドモデルに必要な能力であると強調しました。智象未来は、視覚生成からワールドモデリングへと進化し、現実世界の状態を統一的に理解・生成・予測することを目指しています。