不止Kimi K3,北京AI正在補上Action拼圖

重點摘要
北京AI企業月之暗面的Kimi K3與千尋智能的Spirit v1.6分別在數字智能與物理智能領域取得全球領先突破,前者在編程榜超越閉源模型,後者於具身智能榜單登頂。兩家公司均選擇底層技術自研路線,並透過開源策略展現自信,共同勾勒出北京AI從數字空間走向物理世界的完整創新版圖。
7月24日上午,北京市委主要領導圍繞智能經濟展開調研,接連走訪了三家人工智慧企業:360、月之暗面與千尋智能。這場調研的時機耐人尋味——就在一週前,月之暗面推出的Kimi K3大模型才剛完成一場驚豔全球的亮相。馬斯克在社群媒體上將其列為Grok 4.5的「重點追趕目標」;OpenAI戰略負責人坦言,Kimi K3的性能「無法靠簡單蒸餾實現」;高盛甚至特別發布研報,稱這是「中國大模型走向定價權的全新節點」。一時間,全球目光都聚焦到北京這座城市。然而,如果只看見Kimi這一家公司,恐怕就會錯過北京AI正在發生的真正結構性變化。
距離月之暗面所在的園區約13公里之外,另一家北京企業千尋智能,早已在RoboArena榜單上登頂全球第一。其自研的Spirit v1.6具身基座模型,成功超越英偉達的DreamZero以及Physical Intelligence的Pi0.5,成為中國首個奪下該榜冠軍的具身模型。更令人驚豔的是,千尋智能的Moz1機器人已經在真實場景中展現出驚人實力。它不僅能僅憑一句自然語言指令,便完成「客廳收納」這類長程複雜任務,而且已在寧德時代的產線上常態化運行,作業成功率穩定維持在99%以上。新一代商務服務機器人Moz2則在WAIC期間亮相,吸引眾多目光。
這兩家公司,一個讓AI在數位世界裡學會思考,一個讓AI在物理世界裡學會行動。外界或許會把它們歸入不同賽道——大模型 vs.具身智能,看似互不相關。但正是這兩家看似不搭界的公司,正共同成為北京AI面向世界的「兩張新名片」,聯手勾勒出AI從數位空間走向物理世界的完整創新版圖。仔細觀察會發現,它們共享同一種「基因」:都押注底層技術創新,而非在應用層簡單套殼;都將底層能力開放給全球檢驗;並且都在各自領域站上了全球牌桌的最前排。
Kimi K3的性能躍升,源於Moon Clip二階優化器、Kimi Linear Tension線性注意力機制、Attention Residuals注意力殘差三項原創架構,直接在優化器、注意力機制、殘差連接等基礎組件上做出結構性突破。月之暗面Kimi企業業務負責人黃震昕曾坦言:「我們的目標從來不是做高性價比的雕琢。」正如其英文名Moonshot所傳達的,他們選擇的是一場如同登月般艱難、卻被視為正確且有價值的技術探索。千尋智能走的則是同一條路。創始人兼CEO韓峰濤曾判斷,至少在第一波具身智能創業浪潮裡,應該沒有再做基座模型的機會了。
這意味著,沿著別人的技術路線做跟隨式改良,連入場券都可能拿不到。因此,千尋智能選擇從具身基座模型、一體化力控關節到數據採集體系,全盤自研。其Spirit v1.6模型採用VLA與世界模型深度融合的架構,從物理世界的感知與控制需求出發重構底層邏輯,回到Physical AI的第一性原理。如何在現有技術路線之外走出新路,是千尋必須回答的命題。兩家公司還有一個不容忽略的交集:領軍人物都來自清華。Kimi創始人楊植麟出身清華,千尋聯合創始人兼首席科學家高陽則是「伯克利歸國四子」之一,現任清華交叉信息研究院助理教授。
讓頂尖學者走出實驗室,做「難而正確」之事,這既是兩家公司的共同底色,也是北京AI頗具辨識度的基因。在開源策略上,兩家公司同樣不謀而合。Kimi K3發布後,黃震昕曾強調:「開源模型不該貼上低價標籤。」K3以開源模型身份登頂Frontend Code Arena程式設計榜榜首,首次在該榜單超越頭部閉源模型,被外媒稱為「DeepSeek 2.0時刻」。發布後甚至供不應求,C端新用戶訂閱一度暫停。千尋智能則在具身智能這個更年輕的賽道裡做著同樣的事:Spirit v1.5開源即超越美國標竿Pi0.5,搭載Spirit v1.
6的Moz1在WAIC現場首次挑戰「一句話整理客廳」這類長程複雜推理任務,打破了行業長期以來的「金魚記憶」瓶頸。兩家公司開源策略的底層邏輯一致:不是「做不出好的所以開源」,而是「做出了最好的所以開源」。Kimi創始人楊植麟曾說:「我們既能做非常前沿的研究,又願意把模型開源出來、把技術開放出來,這在全球來看是其他國家的企業很難做到的。」千尋亦是如此——從一開始的設計就是做通用具身模型,開源、開放、包容並蓄,啃行業最難啃的骨頭。若把Kimi K系列與千尋智能Spirit系列的演進史放在一起,還能看出更多共識。「垂直整合」是兩家公司共同的追求。
Kimi堅持「模型公司一定要做模型」;千尋智能則是Physical AI基礎模型方向的原生創新者。兩家公司的技術迭代都不是「畢其功於一役」:Kimi從底層架構三件套的逐步打磨到K3的爆發,千尋智能從Spirit v1到v1.5再到v1.6的逐代躍遷,它們都在做長期、持續、可積累的進化。垂直整合是下限,真實場景中的持續迭代決定了上限。Kimi和千尋在兩條賽道上各自驗證了同一件事:中國AI團隊能夠從基礎層定義自己的技術路線,並使其成為一種可以被複用和放大的創新範式。北京之所以能同時孕育出這兩家全球級選手,與這座城市深厚的AI人才池密不可分。
北京擁有中國密度最高的AI人才庫,為基礎模型和前沿技術創新提供了持續的人才供給。而在7月24日的調研中,北京也釋放出三組明確關鍵詞:「持續提升基礎大模型能力」「探索世界模型多技術路線」「促進具身智能等前沿領域發展」——恰好與Kimi和千尋的技術主航道一一對應。從全球競爭視角看,矽谷有OpenAI、Anthropic主導數字智能,有Figure、Optimus攻堅具身智能,但很難在同一座城市同時找到兩條賽道的全球級選手。而北京恰恰聚集了兩家。Kimi和千尋智能的崛起,支撐起數字智能和物理智能兩條全球AI前沿路線。如今,北京不僅擁有全球競爭力的大模型企業,也正在孕育具身智能領域的全球競爭者。
Kimi K3讓世界看到了北京AI在數位世界的技術高度,千尋智能Spirit v1.6則證明這種突破正在進入物理世界。當馬斯克將Kimi K3列為追趕目標,當Spirit v1.6在RoboArena中超越英偉達與Physical Intelligence,北京AI企業正在完成一次集體身份轉變:從跟隨者到定義者。數位世界的智能邊界正在被重新丈量,物理世界的智能版圖剛剛開始繪製。而這一次,北京兩家企業的座標已經同時標在了兩張地圖的起點上。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。