鈦媒體模型更新

取次硅谷懶回顧,半緣DeepSeek半緣Kimi

2026年7月23日 09:38
取次硅谷懶回顧,半緣DeepSeek半緣Kimi

重點摘要

取次硅谷懶回顧,半緣DeepSeek半緣Kimi數字力場2026.07.23 09:36 · 來自北京全文6558字00:00 / 15:21DeepSeek擅長以柔克剛,如果說“大力出奇跡”的scaling law路線是剛,那MoE稀疏激活+原生FP8訓練框架+純RL驅動的卸力打法就是柔。

站內 AI 整理稿

# 取次硅谷懶回顧,半緣DeepSeek半緣Kimi

**從“攪局者”到“破局者”,中國AI雙子星如何改寫全球格局**

過去兩年,全球人工智能賽道最引人注目的變量,莫過於來自中國的兩家創業公司——DeepSeek與Kimi。它們像一對配合默契的“玉面雙飛龍”,交替出擊,屢次讓硅谷和華爾街措手不及。2025年初,DeepSeek R1以顛覆性的成本優勢震驚業界,被馬克·安德森稱為“斯普特尼克時刻”;一年半後,Kimi K3攜2.8萬億參數規模強勢登場,再度點燃市場情緒,引發美股AI板塊市值單週蒸發4700億美元。從“大力出奇跡”的Scaling Law崇拜,到稀疏激活、純RL驅動的技術路徑創新,中國大模型正從追趕者逐步蛻變為規則的改寫者。 **Kimi K3“王者歸來”,硅谷與華爾街集體震動**

2026年7月,Kimi正式發佈K3模型,其綜合能力在Artificial Analysis智能指數中排名全球第三,前端代碼生成能力登頂Arena榜首,智能體與長文檔檢索等維度亦奪得第一。馬斯克罕見留言“Impressive”,OpenAI戰略負責人公開稱之為“減速主義力量”,《華爾街日報》頭版打出“The Kimi Shock”標題。高盛研報則認為,K3標誌著中國模型從“性能追趕”走向“定價權節點”。這場衝擊波迅速傳導至資本市場:費城半導體指數單週大跌12.5%,英偉達等AI龍頭股價劇烈波動,“DeepSeek時刻”再次上演。 值得玩味的是,就在一年多前,Kimi還經常被當作DeepSeek的“反面鏡像”,業內不乏“Kimi掉隊了”的論調。如今,K3用實實在在的榜單成績和市場反響證明了自己的爆發力。從DeepSeek以“柔”克剛——通過MoE稀疏激活、原生FP8訓練框架和零樣本自進化路線實現低成本突破——到Kimi以“剛”破局——超大容量稀疏MoE基座、KDA混合線性注意力、全鏈路強化學習範式——兩家企業在不同技術路徑上分別達到了世界一流水平。 **從“性價比”到“高性能”,中國AI角色躍遷**

DeepSeek R1問世時,外界最大的感嘆是“性能接近頂尖,價格僅為百分之一”。它打破了硅谷依靠“閉源付費+高端性能”收割全球市場的想象空間,卻尚未在綜合能力上對GPT、Claude和Gemini形成絕對優勢。然而Kimi K3的出現改寫了這一局面:在複雜邏輯推理、長文本理解、代碼生成及多場景落地等核心維度,K3已能與Anthropic、OpenAI的旗艦模型正面抗衡,甚至在部分評測中實現反超。 加州大學伯克利分校教授伊恩·斯托伊卡坦言:“過去我們常說開源模型落後最前沿6至9個月,現在差距可能只剩2到3個月。”這種從“產品不錯、價格合理”到“性能亦能登頂”的跨越,令硅谷部分企業失去了“反正還有追趕窗口期”的心理優勢。摩根士丹利評價稱,K3證明了中國大模型在規模、性能、定價層面對美國頭部模型的“全方位追趕”。 **差距仍在,但“原創意識”覺醒**

儘管突破連連,但冷靜審視,中美AI的整體差距依然存在。底層算力方面,高端芯片自主可控率仍有待提升;生態成熟度上,硅谷“算力+模型+工具+場景+資本”的完整閉環仍具壓倒性優勢;頂尖人才池的厚度亦有差距。但更值得關注的是,DeepSeek與Kimi正在改變“模仿追隨”的慣性,轉向架構級的原創創新。 DeepSeek創始人梁文鋒曾直言:“中國AI和美國的真實差距是原創和模仿之差。如果不改變這個,中國永遠只能是追隨者。”正因為看到這點,DeepSeek開發了原生鏈式思考、MLA注意力機制與零樣本自進化訓練;Kimi則首創了KDA混合線性注意力體系與Agent Swarm協同框架,並在MuonClip大規模訓練優化器上實現工程突破。這些原創成果不僅提升性能,更在降低算力依賴、突破訓練瓶頸方面給出了中國方案。 **良性競爭催生創新活力,雙子星重塑行業敘事**

有趣的是,DeepSeek與Kimi之間存在著深厚的“競合”關係:Kimi採用了DeepSeek早期提出的MLA注意力思想,而DeepSeek V4中關鍵的Muon優化器則由Kimi團隊率先驗證成效。二者在產品發佈節奏上亦你追我趕——2025年1月,R1與K1.5同日上線,間隔僅兩小時;此後,注意力機制論文、數學推理模型、Agent能力升級等相繼交替推出。這樣的相互“致敬”與賽馬,形成了國內難得的良性競爭生態,也讓兩家企業都在壓力下爆發更強創新力。 從《少林足球》中的“玉面雙飛龍”到如今的DeepSeek與Kimi,一個以柔克剛、一個爆發力十足,它們共同構成了中國AI最具活力的面孔。梁文鋒的“追求原創”與楊植麟的“願意做不知道的東西”,代表了新一代創業者的務實銳氣。正如楊植麟所說:“Problems are inevitable, but problems are soluble。”正是這種直面問題、敢於探索未知的勇氣,讓中國AI從全球賽場的邊緣逐漸走向中央。 **持續進化,方能不負“破局”之名**

取次硅谷懶回顧,半緣DeepSeek半緣Kimi。這句話道出了許多行業觀察者的共同感受:當中國AI能持續拿出世界級成果時,對硅谷的仰視心態正被平視所取代。當然,一次驚豔可能是偶然,但兩次不同企業、不同時間、不同技術路徑的深層突破,便足以說明體系化創新的動能正在形成。未來,保持對基礎架構的投入、維護開放競爭的市場環境、吸引更多頂尖人才回歸,將是中國AI從“破局者”進一步躍升為“引領者”的關鍵。 正如那對電影組合所言:“我們玉面雙飛龍,可不是浪得虛名。”DeepSeek與Kimi的接連出擊,已經讓世界看到了中國人工智能的真正實力。而這一天,或許才剛剛開始。

Related

相關文章

對話FutureTech張夢釗:從“一個人+一群Agent”到超級個體,AI正在重塑創業範式

賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務尋求報道36氪Pro創投氪堂企業入駐創業者服務創投平臺AI測評網 首頁快訊資訊推薦財經AI自助報道廣東最新創投汽車科技專精特新直播視頻專題活動搜索尋求報道我要入駐城市合作對話FutureTech張夢釗:從“一個人+一群Agent”到超級個體,AI正在重塑創業範式未來一氪·2026年07月23日 10:57WAIC專訪FutureTech張夢釗:談AI創業與平臺生態 7月17日,2026世界人工智能大會在上海開幕。作為36氪連續第三年深入WAIC現場的重要內容窗口,「氪話未來」直播間也在大會首日同步開啟現場對話。FutureTech負責人張夢釗在WAIC現場接受36氪「氪話未來」特邀專訪,圍繞FutureTech平臺定位、OPC獨立先鋒挑戰賽、AI創業趨勢以及初創企業商業化路徑等話題,分享了FutureTech如何連接創業團隊、產業資源與創新生態,探索AI時代下的新型創業範式。 本屆WAIC以“智能夥伴,共創未來”為主題。隨著人工智能產業進入應用深化階段,行業關注點正在從模型能力競爭逐步轉向應用價值創造。相比過去幾年圍繞參數規模、模型性能和技術突破的討論,2026年的AI產業正在更加關注一個核心問題:AI如何真正進入企業業務流程,如何降低應用門檻,如何通過實際業務結果創造價值。 在這一趨勢下,AI創業競爭的核心也正在從單純的技術能力比拼,轉向對行業認知、場景理解和商業價值創造能力的考

剛剛

4小時、11個話題、118次回答,梁文鋒內部交流回應一切

# 4小时、11個話題、118次回答,梁文鋒內部交流回應一切 在DeepSeek完成成立以來首輪外部融資、募資總額超500億元人民幣之際,創始人梁文鋒近日在一場投資者交流會上長達近4小時的發言細節被曝光。據騰訊科技獲得的交流會實錄整理,梁文鋒圍繞公司願景、AGI路線圖、團隊文化、算力策略、開源邏輯及行業競爭格局等11個核心話題,作出了118次回答,全面揭示了這家此前堅持“不融資、不上市、不商業化”原則的AI公司為何轉向資本市場,以及其內心深處對人工智能未來的真實判斷。

剛剛
IT之家模型更新

Acrab 發佈邊緣 AI 終端 SoC GΞLIX 1,支持 100B 模型本地運行

首頁 > 智能時代>人工智能 Acrab 發佈邊緣 AI 終端 SoC GΞLIX 1,支持 100B 模型本地運行 2026/7/23 9:05:36 來源:IT之家 作者:溯波(實習) 責編:溯波 評論: IT之家 7 月 23 日消息,初創企業 Acrab 昨日正式發佈了其首款芯片:面向邊緣 AI 終端設備的 GΞLIX 1 SoC。

剛剛

真實工作流,正在成為下一代訓練數據

在人工智慧模型訓練的領域,數據的品質與來源正經歷一場關鍵轉變。過去業界大量仰賴合成數據或人工標註的靜態資料集,但隨著模型對複雜任務的理解需求日益升高,一種新的趨勢悄然浮現——真實工作流(real-world workflow)正逐步成為下一代訓練數據的核心。所謂真實工作流,指的是人類在實際工作場景中,為完成特定任務所經歷的一系列操作、決策與工具使用過程,包括錯誤修正與重試路徑。

剛剛