對話Om AI趙天成:多年堅守,押注物理AI原生的「流式」未來

重點摘要
好的,這是一篇基於您提供的資料,重新撰寫的完整新聞稿。 --- ## 對話Om AI趙天成:多年堅守,押注物理AI原生的「流式」未來 在AI領域,當所有人都在追逐大語言模型帶來的生成式AI浪潮時,有一家公司卻選擇了一條截然不同的路:死磕「視覺+語言」的流式多模態技術。這家名為Om AI聯匯的公司,在經歷了多年的沉澱與市場的質疑後,終於在物理AI時代到來的今天,迎來了屬於自己的爆發時刻。其創始人兼首席科學家趙天成博士,用多年的時間驗證了一個「反共識」判斷的商業樣本,證明了長期主義在AI產業變革中的價值。
好的,這是一篇基於您提供的資料,重新撰寫的完整新聞稿。 ---
## 對話Om AI趙天成:多年堅守,押注物理AI原生的「流式」未來
在AI領域,當所有人都在追逐大語言模型帶來的生成式AI浪潮時,有一家公司卻選擇了一條截然不同的路:死磕「視覺+語言」的流式多模態技術。這家名為Om AI聯匯的公司,在經歷了多年的沉澱與市場的質疑後,終於在物理AI時代到來的今天,迎來了屬於自己的爆發時刻。其創始人兼首席科學家趙天成博士,用多年的時間驗證了一個「反共識」判斷的商業樣本,證明了長期主義在AI產業變革中的價值。時間回溯到2023年,彼時AI行業的目光正聚焦於大語言模型。一個意外的契機,卻讓趙天成更加堅定了自己的判斷。當時,一位從事衛生管理的客戶提出,是否能將Om AI的多模態模型接入其監控攝像頭。
這在當時看來並非一個理想的場景,因為傳統基於小模型的計算機視覺方案已被反覆驗證,泛化性極差。然而,當Om AI的模型被應用於此場景時,奇蹟發生了:這個從未見過監控畫面的多模態模型,其表現竟然超越了在監控數據上訓練多年的「老將」。這次「無心插柳」讓趙天成深刻體認到,基於多模態的訓練方式,能夠為開放世界的物理場景帶來前所未有的泛化能力。正是基於這一判斷,Om AI聯匯聚焦於一個極具前瞻性的技術方向——「端側原生流式多模態」。三年後,這個理念演化成了VLX系列模型,這是全球首個面向物理AI的端側流式多模態模型系列。
與行業主流的「離線抽幀」處理方式不同,VLX模型從 Day 1 就為端側算力約束設計,首次實現了「持續感知+精準定位+行動決策」的物理AI完整閉環。趙天成指出,物理世界的信息輸入是連續的視頻流,而非離散的文本流,任何要在物理世界發揮作用的AI,都必須具備快速、絲滑的流式交互能力,這也是流式多模態技術不可替代的底層價值。對於當前物理AI領域喧囂的技術路線之爭,趙天成有著自己清醒的認識。他認為,無論是VLA還是世界模型,都只是概念,而物理AI的本質在於模型必須同時具備四種核心能力:理解語義內容、認知幾何空間、進行決策與動作控制,以及對未來進行預測。
Om AI發佈的VLX模型中的「X」,正代表了這四種能力的無限可能。他不認同「VLA已死,世界模型已來」的炒作說法,強調方法和概念不應掛鉤,物理AI是一個多維度的系統工程,而Om AI的任務就是從底層架構上,為物理終端提供一個能夠理解世界並自主行動的「大腦」。在商業化佈局上,Om AI聯匯的策略極具務實性,遵循「先成熟,後新興」的路徑。趙天成認為,物理AI的落地與終端的商業化成熟度息息相關。因此,Om AI的戰略是「一腦多形」,將強大的流式多模態能力賦能給各類終端。從成熟的硬件如IoT攝像頭、AI PC、個人智能終端開始,逐步向無人機、機器狗等新興終端延伸,最終邁向人形機器人。
這種策略不僅能讓Om AI的模型在真實場景中迅速落地,形成數據飛輪,還能將成熟場景的經驗反哺給新興本體,實現快速迭代。如今,這套打法已經幫助Om AI完成了從技術到商業的閉環,實現了以億為單位的營收。趙天成回顧創業歷程,將其分為幾個關鍵階段。首先是市場教育,讓客戶理解「多模態模型」這一全新概念;其次是跨越技術突破與產品驗收之間的鴻溝,將實驗室裡從60分到80分的「突破」,打磨成用戶滿意的95分產品;最後是產品理念的升級,實現真正的「AI原生」設計。這三個階段的跨越,每一步都充滿挑戰,但正是憑藉對技術的深刻理解與對產業的務實態度,Om AI才能一步步走到今天。面對未來,趙天成保持著從容與自信。
他將當下的物理AI市場比作「寒武紀大爆發」,機會巨大,但路線遠未收斂。他相信,Om AI的先發優勢不僅體現在技術儲備上,更體現在已經轉動起來的數據飛輪和場景生態上。通過讓更多的終端先用先跑,Om AI正在構築一道堅實的護城河,而這種馬太效應將吸引更多的資源、數據和客戶。當被問及為何從一開始就如此堅定地選擇流式多模態時,趙天成提到了在卡耐基梅隆大學的經歷。他師從對話系統開山鼻祖,並親手締造了第三代對話系統,但他始終覺得,純文本的對話離他心目中「活的」AI差了一步。直到他參與了雅虎價值十億美金的多模態智能體項目,他才深切感受到多模態價值的上限。
他認為,視覺和語言是物理世界中最重要的兩個模態,將它們融合,才是通往真正智能體的正確路徑。Om AI聯匯的故事,並非一個簡單的追風者故事,而是一個關於判斷力、定力與長期主義的商業樣本。當產業的需求曲線與技術的積累曲線在2026年終於交匯,趙天成和他的團隊用多年的沉默與堅守,換來了物理AI浪潮中的先發優勢。他們證明了,在瞬息萬變的AI時代,能夠抵達終局的,不僅需要跑得快,更需要看得遠,並且從不偏離方向。如今,隨著VLX系列模型的連續發佈,Om AI聯匯正準備在物理AI這場更大的戰役中,書寫屬於自己的篇章。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。