合肥又押中AI獨角獸:多模態賽道,3個月融了21億

重點摘要
智象未來(HiDream.ai)在三個月內完成三輪融資共21億元,估值突破10億美元,躋身全球AI獨角獸行列。該公司走原生全模態路線,推出UiT架構與vivago R1創作智能體,在文生圖與長視頻生成領域展現差異化優勢,並獲國家級、產業及地方資本共同押注。
合肥又押中AI獨角獸:多模態賽道,3個月融了21億
7月23日,智象未來(HiDream.ai)正式宣佈完成15億元C輪融資。這已是這家多模態大模型公司在近三個月內完成的第三輪密集融資,三輪合計金額超過21億元。隨著本輪資金到位,智象未來估值突破10億美元,正式躋身全球AI獨角獸行列。真正引人關注的不只是融資數字,而是背後投資方的組成與邏輯。本輪融資由社保基金四川振興科創基金、工銀資本、弘頤資管、敦鴻資本聯合領投,廈門國貿資本、上影新視野基金、湖北長江產業投資集團、華策影視、航源資本、創雲海資本、華福投資、餘杭金控股份、交銀資本、若松基金等多家機構跟投。老股東方面,合肥產投、東方富海、金浦投資、金華金投、中哲創、財鑫資本持續加碼。
風格與佈局邏輯截然不同的資本罕見地扎堆押注同一家創業公司,反映出市場對智象未來技術路線與商業前景的高度共識。智象C輪融資的時間點恰好踩在AI行業範式切換的關鍵拐點。過去幾年,大語言模型憑藉代碼生成與文本交互能力長期佔據資本核心,參數規模與推理速度成為競爭標尺。然而,隨著新一代開源與開放權重模型密集發佈,市場對大語言模型估值溢價的分歧明顯加劇,部分已上市AI模型公司股價波動加大。單純依靠參數堆疊與文本能力領跑的模式,已逼近工程天花板。與此同時,AI視覺賽道卻迎來資本集中爆發。
據不完全統計,2026年國內AI視覺領域融資總額已逼近300億元,多模態成為繼AI Coding之後商業化確定性最高的賽道之一。智象未來能在資本市場受到矚目,自然離不開這股時代浪潮。但賽道升溫不代表所有人機會均等,市場只會把籌碼押給真正的頭部玩家。翻開智象的投資人名單,幾個鮮明特徵躍然紙上:國家級資本站臺、多元資本集結、以及「首次出手」的稀缺性。公開資料顯示,這是社保基金作為LP首次投資多模態大模型方向,也是工銀資本第一次出手此領域。
跟投名單中還包含來自安徽、上海、浙江、福建、湖南多地的國資,上影股份與華策影視兩家頭部影視上市公司並肩入局,東方富海、弘頤資管、敦鴻資本等頂級市場化VC也紛紛進場。這種多元化的投資人結構在當下一級市場中並不多見,不同屬性的資金在此看到了不同的價值錨點。對國家級資本而言,關注的是「路線」——全模態世界模型是否成立尚無定論,但如果這一方向最終跑通,其戰略意義將不止於單一商業場景,而可能成為下一代AI基礎設施的重要組成部分。
影視產業資本則將此次投資視為卡位內容產業革命的前置佈局,上影股份、華策影視已與智象未來達成多項合作,涵蓋新型內容創制、院線場景升級、AI跨屏整合營銷、AI大屏製片標準與工作流程制定等方向。對地方國資而言,算的是產業賬。合肥過去十年接連投資長鑫科技、京東方等高科技企業,擅長在行業黎明期下重注,如今智象未來被擺在相似的位置上。而敦鴻資本、弘頤資管、東方富海等市場化機構集體入局,則是基於硬核技術落地價值的專業判斷,多家機構更是首次佈局視覺大模型賽道。這些不同背景的出資人從各自座標出發,看到同一個方向上的不同切面,最終拼出的完整圖景指向一個更底層的問題:他們共同押注的究竟是什麼樣的技術敘事?
答案要回到大模型通往AGI的路線分歧。過去兩三年,AI行業主流敘事是「規模法則」,但楊立昆等學者多次表示,三到五年內世界模型將取代LLM成為主流AI架構。LLM本質上是「書齋裡的思想家」,智能被局限在人類文明已編碼的符號系統之內;世界模型則試圖讓AI理解物理世界中的空間、時間、因果與交互。智象未來選擇從視覺像素出發,構建原生全模態架構,核心判斷是圖像為信息密度極高的模態之一。傳統的多模態模型本質上是「縫合怪」,在語言模型之外掛上圖片理解與生成模塊,各模態分別編碼,最後在外層拼接,信息在傳遞過程中不斷損耗。
智象的UiT架構則將圖像像素、文本Token、視頻體素以及音頻、動作、空間關係等原始信號,由同一套Transformer完成理解、生成與推理,不設獨立文本編碼器,不用VAE作為模態間傳導介質,所有信號統一tokenization,端到端地在同一網絡中完成多任務處理:文生圖、長文本渲染、指令編輯、主體驅動、故事板生成,全部由同一個模型完成。這套架構已在第三方評測中交出可驗證的答卷。
2026年5月,智象旗下HiDream-O1-Image(8B參數開源版本)以「Peanut」匿名登上全球知名AI模型評測平台Artificial Analysis,並在文生圖榜單奪得開源模型第一,同時是榜單前20名模型中參數最小的版本。隨後商用版HiDream-O1-Image-1.5再次成為該榜單排名最高的中國圖像模型,位列全球前三,在光影、複雜構圖、指令跟隨與中英文字渲染上表現突出。除了底層技術,智象未來已搭建起成熟的「1+1+3」商業化體系,實現底層技術、平台能力、場景應用的三級跳落地。
第一層為HiDream全模態大模型底座;第二層為HiHarness企業能力中台,輸出標準化、可複用的模型能力;第三層聚焦商業營銷、影視創作、社媒創作三大垂直場景,打造專屬AI智能體產品。其中,在WAIC重磅發佈的vivago R1多模態創作智能體,成為全球首款支持無限時長視頻自主生成與編輯的創作智能體,搭載長鏈路敘事規劃能力,摒棄傳統「抽卡式」隨機生成模式,將AI內容商用有效成功率提升至85%。近期創作者社群中流傳一個測試案例:有人在vivago R1上輸入指令,要求生成一部「葉什爾查姆風格」的荒誕科幻短片。
葉什爾查姆是土耳其上世紀六七十年代的商業電影黃金時代,其低成本山寨片以粗糲道具、拼貼素材與誇張表演聞名,精髓在於「廉價到極致,反而形成獨特幽默感」。對於AI視頻模型而言,這不僅要求輸出符合物理規則的畫面,還要刻意保持低成本質感,精確踩中風格閾值。vivago R1的處理結果被認為精準捕捉了那種荒謬感——硬紙板怪獸、手繪背景、廉價特效質感都被復現,鏡頭敘事邏輯保持連貫。這個案例證明,一個真正可用的創作工具必須能理解風格、執行意圖、保持敘事連貫,而不只是生成漂亮的單幀畫面。
目前vivago海外版已覆蓋全球100多個國家和地區,累計服務超5000萬用戶,今年5月灰度版登頂Product Hunt日榜第一,被矽谷知名product hunter Chris Messina評價為「Think Claude Code, but for video」,商業化落地能力穩居行業第一梯隊。如果說前兩年的AI競賽比的是誰更能「讀懂」人類已有的知識,那麼從現在開始,比的是誰更能「看懂」並「推演」這個物理世界。這是一場從文本智能到物理智能的範式躍遷,也是世界模型賽道最迷人的不確定性。沿著原生全模態技術路線,智象未來的演進節奏與落地效果,值得長期追蹤。
隨著這一輪融資塵埃落地,世界模型的牌桌擺開,真正的競賽才剛剛鳴槍。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。