全球最大開源模型來了!月之暗面發佈2.8萬億參數Kimi K3,劍指Anthropic

重點摘要
月之暗面發布全球最大開源模型Kimi K3,參數規模達2.8兆,採用開放權重模式,被視為對標Anthropic旗艦模型Claude Opus 4.8。該模型在多項基準測試中表現接近或比肩國際頂級閉源模型,展現中國開源AI的快速進展。
月之暗面正式打響中國大模型新一輪「開源戰」。7月16日,該公司發佈新一代開源基礎模型Kimi K3,參數規模高達2.8萬億,同步上線API服務及開發者文檔。根據新華社報導,這是目前全球參數最大的開源模型,標誌著中國人工智慧模型發展邁出關鍵一步。Kimi K3是月之暗面推出的又一萬億級參數旗艦開源模型,也是該公司迄今最強的基礎模型。繼DeepSeek之後,月之暗面成為又一家將最先進模型以開放權重(Open Weight)方式向全球開發者開放的中國頭部AI公司。這款模型正式發佈前,海外媒體已陸續報導,稱Kimi K3被月之暗面內部視為對標Anthropic最新旗艦模型Claude Opus 4.
8的關鍵產品,整體性能有望達到甚至超越Opus 4.8的主流基準測試成績,被認為可能進一步縮小中美最前沿AI模型之間的性能差距。根據月之暗面官方介紹,Kimi K3採用混合專家(MoE)架構,總參數達2.8萬億,是公司規模最大、能力最強的基礎模型。模型支援100萬Token的上下文窗口,並原生具備視覺理解能力,重點面向長週期軟體工程、複雜推理以及知識工作等高難度任務。與先前主要面向消費者的Kimi智能助手不同,Kimi K3更加強調開發者生態建設。
月之暗面同步開放模型權重,並提供API及開發文檔,開發者既可免費下載模型進行本地部署,也可直接調用官方雲端服務,加快企業和開發者基於K3構建AI應用。官方公佈的評測結果顯示,Kimi K3在代碼生成、Agent任務執行、數學推理等多個主流基準測試中取得具有競爭力的成績。其中,在軟體工程基準SWE-bench Verified、編程競賽基準LiveCodeBench、Agent能力測試Tau2以及數學推理基準AIME等測試中,Kimi K3均達到當前開源模型領先水平,並在部分項目中接近或比肩國際頂級閉源模型。新華社報導指出,在評測中Kimi K3綜合智能水平接近全球前沿的閉源模型。
月之暗面相關負責人介紹,在訓練K3新一代基座大模型的過程中,使用了自主研發的底層模型架構,並累積形成一整套科學的模型訓練方法。月之暗面此次採用開放權重模式發佈Kimi K3,而非僅提供API訪問。這意味著開發者不僅可以下載模型、自行部署和二次開發,還能根據自身需求進行微調和定製。事實上,在Kimi K3正式亮相前,海外媒體已提前數日密集關注這款模型。有報導稱,K3被內部定位為中國目前規模最大的AI模型之一,預計將在多項主流基準測試中超越Anthropic的Claude Opus 4.8,並進一步縮小與Anthropic旗艦模型之間的性能差距,是月之暗面迄今最重要的一次模型升級。
雖然Anthropic未公開Opus 4.8的參數規模,但業內普遍估計約為1.5萬億至2萬億參數。《金融時報》引述知情人士稱,Kimi K3雖然預計仍無法超越Anthropic因安全問題暫停發佈的超前沿模型Fable,但已足以挑戰市場長期以來認為「中國模型落後美國8至12個月」的普遍認知。對於美國AI實驗室而言,更大的挑戰不僅來自模型能力,而是商業模式。由於Kimi K3採用開放權重方式發佈,全球開發者可以免費下載、自行部署並進行修改,這意味著它有望像DeepSeek一樣迅速形成開發者生態,對堅持封閉模型策略的OpenAI、Anthropic形成持續競爭壓力。
過去一年,美國AI公司持續投入數千億美元建設AI基礎設施,並不斷推出更強大的前沿模型,與此同時,其商業化價格也持續上升。據Anthropic官網信息,該公司計劃自今年9月起將Claude Opus 4.8價格進一步提高約50%,輸入Token價格升至每百萬3美元,輸出Token價格升至每百萬15美元。相比之下,中國AI公司正採取另一條路徑。包括DeepSeek、月之暗面在內,多家中國AI企業持續推出開放權重模型,不僅允許企業私有化部署,同時整體推理成本明顯低於美國頭部模型。以月之暗面先前發佈的K2.6模型為例,其調用成本約為Claude Opus 4.8的三分之一。
隨著越來越多企業開始關注AI成本控制,不少海外企業也開始嘗試採用中國模型替代部分美國模型,以降低推理支出。美國知名風投Andreessen Horowitz的聯合創始人Marc Andreessen先前就曾表示,智譜發佈的GLM-5.2已成為首個能夠在不少公開測試中與美國大型AI實驗室旗艦模型相匹敵甚至部分領先的中國模型。今年以來,中國AI公司幾乎全部轉向開源路線。DeepSeek憑藉R1系列迅速獲得全球開發者關注;智譜、MiniMax等公司隨後陸續推出開放權重模型;如今月之暗面也正式加入這一陣營。
與此同時,美國頭部AI公司仍堅持閉源路線,OpenAI最新GPT系列、Anthropic Claude旗艦模型均未開放模型權重,而是依賴API訂閱模式持續提高商業化收入。這種模式差異正成為全球AI競爭的新分水嶺。《金融時報》指出,越來越多硅谷投資人和科技企業高管開始認為,中美前沿AI模型之間的性能差距正在快速收窄,而真正決定未來競爭格局的可能不再只是模型排行榜,而是誰能夠建立覆蓋全球開發者的開放生態。資本市場也正在重新評估中國AI公司的價值。據《金融時報》報導,月之暗面正在進行新一輪融資,估值約315億美元;DeepSeek也已啟動新一輪融資,估值約710億美元。
相比之下,Anthropic最新融資後估值約965億美元,OpenAI最新估值約852億美元。隨著Kimi K3正式發佈,中國頭部AI公司與美國前沿實驗室之間的競爭,正從單純的模型能力比拼,進一步延伸至開源生態、開發者社區以及商業模式的全面較量。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。