取次硅谷懶回顧,半緣DeepSeek半緣Kimi

重點摘要
取次硅谷懶回顧,半緣DeepSeek半緣Kimi數字力場2026.07.23 09:36 · 來自北京全文6558字00:00 / 15:21DeepSeek擅長以柔克剛,如果說“大力出奇跡”的scaling law路線是剛,那MoE稀疏激活+原生FP8訓練框架+純RL驅動的卸力打法就是柔。
# 取次硅谷懶回顧,半緣DeepSeek半緣Kimi
**從“攪局者”到“破局者”,中國AI雙子星如何改寫全球格局**
過去兩年,全球人工智能賽道最引人注目的變量,莫過於來自中國的兩家創業公司——DeepSeek與Kimi。它們像一對配合默契的“玉面雙飛龍”,交替出擊,屢次讓硅谷和華爾街措手不及。2025年初,DeepSeek R1以顛覆性的成本優勢震驚業界,被馬克·安德森稱為“斯普特尼克時刻”;一年半後,Kimi K3攜2.8萬億參數規模強勢登場,再度點燃市場情緒,引發美股AI板塊市值單週蒸發4700億美元。從“大力出奇跡”的Scaling Law崇拜,到稀疏激活、純RL驅動的技術路徑創新,中國大模型正從追趕者逐步蛻變為規則的改寫者。 **Kimi K3“王者歸來”,硅谷與華爾街集體震動**
2026年7月,Kimi正式發佈K3模型,其綜合能力在Artificial Analysis智能指數中排名全球第三,前端代碼生成能力登頂Arena榜首,智能體與長文檔檢索等維度亦奪得第一。馬斯克罕見留言“Impressive”,OpenAI戰略負責人公開稱之為“減速主義力量”,《華爾街日報》頭版打出“The Kimi Shock”標題。高盛研報則認為,K3標誌著中國模型從“性能追趕”走向“定價權節點”。這場衝擊波迅速傳導至資本市場:費城半導體指數單週大跌12.5%,英偉達等AI龍頭股價劇烈波動,“DeepSeek時刻”再次上演。
值得玩味的是,就在一年多前,Kimi還經常被當作DeepSeek的“反面鏡像”,業內不乏“Kimi掉隊了”的論調。如今,K3用實實在在的榜單成績和市場反響證明了自己的爆發力。從DeepSeek以“柔”克剛——通過MoE稀疏激活、原生FP8訓練框架和零樣本自進化路線實現低成本突破——到Kimi以“剛”破局——超大容量稀疏MoE基座、KDA混合線性注意力、全鏈路強化學習範式——兩家企業在不同技術路徑上分別達到了世界一流水平。**從“性價比”到“高性能”,中國AI角色躍遷**
DeepSeek R1問世時,外界最大的感嘆是“性能接近頂尖,價格僅為百分之一”。它打破了硅谷依靠“閉源付費+高端性能”收割全球市場的想象空間,卻尚未在綜合能力上對GPT、Claude和Gemini形成絕對優勢。然而Kimi K3的出現改寫了這一局面:在複雜邏輯推理、長文本理解、代碼生成及多場景落地等核心維度,K3已能與Anthropic、OpenAI的旗艦模型正面抗衡,甚至在部分評測中實現反超。加州大學伯克利分校教授伊恩·斯托伊卡坦言:“過去我們常說開源模型落後最前沿6至9個月,現在差距可能只剩2到3個月。
”這種從“產品不錯、價格合理”到“性能亦能登頂”的跨越,令硅谷部分企業失去了“反正還有追趕窗口期”的心理優勢。摩根士丹利評價稱,K3證明了中國大模型在規模、性能、定價層面對美國頭部模型的“全方位追趕”。**差距仍在,但“原創意識”覺醒**
儘管突破連連,但冷靜審視,中美AI的整體差距依然存在。底層算力方面,高端芯片自主可控率仍有待提升;生態成熟度上,硅谷“算力+模型+工具+場景+資本”的完整閉環仍具壓倒性優勢;頂尖人才池的厚度亦有差距。但更值得關注的是,DeepSeek與Kimi正在改變“模仿追隨”的慣性,轉向架構級的原創創新。DeepSeek創始人梁文鋒曾直言:“中國AI和美國的真實差距是原創和模仿之差。如果不改變這個,中國永遠只能是追隨者。
”正因為看到這點,DeepSeek開發了原生鏈式思考、MLA注意力機制與零樣本自進化訓練;Kimi則首創了KDA混合線性注意力體系與Agent Swarm協同框架,並在MuonClip大規模訓練優化器上實現工程突破。這些原創成果不僅提升性能,更在降低算力依賴、突破訓練瓶頸方面給出了中國方案。**良性競爭催生創新活力,雙子星重塑行業敘事**
有趣的是,DeepSeek與Kimi之間存在著深厚的“競合”關係:Kimi採用了DeepSeek早期提出的MLA注意力思想,而DeepSeek V4中關鍵的Muon優化器則由Kimi團隊率先驗證成效。二者在產品發佈節奏上亦你追我趕——2025年1月,R1與K1.5同日上線,間隔僅兩小時;此後,注意力機制論文、數學推理模型、Agent能力升級等相繼交替推出。這樣的相互“致敬”與賽馬,形成了國內難得的良性競爭生態,也讓兩家企業都在壓力下爆發更強創新力。從《少林足球》中的“玉面雙飛龍”到如今的DeepSeek與Kimi,一個以柔克剛、一個爆發力十足,它們共同構成了中國AI最具活力的面孔。
梁文鋒的“追求原創”與楊植麟的“願意做不知道的東西”,代表了新一代創業者的務實銳氣。正如楊植麟所說:“Problems are inevitable, but problems are soluble。”正是這種直面問題、敢於探索未知的勇氣,讓中國AI從全球賽場的邊緣逐漸走向中央。**持續進化,方能不負“破局”之名**
取次硅谷懶回顧,半緣DeepSeek半緣Kimi。這句話道出了許多行業觀察者的共同感受:當中國AI能持續拿出世界級成果時,對硅谷的仰視心態正被平視所取代。當然,一次驚豔可能是偶然,但兩次不同企業、不同時間、不同技術路徑的深層突破,便足以說明體系化創新的動能正在形成。未來,保持對基礎架構的投入、維護開放競爭的市場環境、吸引更多頂尖人才回歸,將是中國AI從“破局者”進一步躍升為“引領者”的關鍵。 正如那對電影組合所言:“我們玉面雙飛龍,可不是浪得虛名。”DeepSeek與Kimi的接連出擊,已經讓世界看到了中國人工智能的真正實力。而這一天,或許才剛剛開始。
Related
相關文章

Meta 旗下 AI 模型測試時意外入侵第三方企業系統
Meta 在進行AI模型安全測試時,因第三方公司Irregular配置錯誤,導致模型意外入侵另一企業系統。涉事模型為Muse Spark 1.1,事件引發對AI模型可能衝出邊界、發動網絡攻擊的擔憂。

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?
字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

千人聯機世界模型“RhOS-World: Khora”正式發佈
RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。

告別反覆操作 OSD,華碩顯示器管理軟件 DisplayWidget Center 接入 AI 智能體
華碩顯示器管理軟體 DisplayWidget Center 推出重大更新,加入 AI 智能體功能,用戶可透過自然語言調整亮度、色溫等參數,無需操作 OSD。該功能支援 CLI 與 Agent Skill,可根據使用習慣自動切換模式,並適用於企業環境的統一部署。

千問App部分功能探索收費,想學豆包能跑通嗎?
千問App於8月7日更新,新增辦公助理等付費功能,基礎功能仍免費,但辦公場景使用額度需付費取得。此舉仿效豆包專業版等產品的訂閱模式,反映AI行業正集體轉向辦公場景收費,以尋求變現機會。

內部賽馬暫停,騰訊、阿里、字節AI辦公產品“合兵”對陣
過去半年,騰訊、阿里巴巴、字節跳動等大廠在AI辦公產品領域經歷內部賽馬後,近期紛紛收攏資源,推出整合方案。騰訊將QClaw業務調整至雲產品六部,與WorkBuddy統一管理;阿里整合三款產品推出千問辦公;字節則將飛書團隊併入豆包。市場數據顯示,6月國內AI辦公智能體平臺月訪問量突破6000萬次,顯示此領域競爭日益激烈。