2.8 萬億參數說送就送,月之暗面這筆賬怎麼算的?

重點摘要
七月二十七日晚間,月之暗面(Moonshot AI)正式將Kimi K3的完整模型權重公開上傳至Hugging Face、GitHub及ModelScope。這款擁有2.8萬億參數的模型,是全球首個逼近三萬億門檻的開放權重模型,任何人皆可免費下載、部署於本地環境或進行二次開發。 就在十天前,馬斯克才在K3的評測報導下留言「Impressive」,隨後旋即宣布xAI的兩萬億參數新模型即將完成初步訓練,「可能超越Kimi」。
七月二十七日晚間,月之暗面(Moonshot AI)正式將Kimi K3的完整模型權重公開上傳至Hugging Face、GitHub及ModelScope。這款擁有2.8萬億參數的模型,是全球首個逼近三萬億門檻的開放權重模型,任何人皆可免費下載、部署於本地環境或進行二次開發。 就在十天前,馬斯克才在K3的評測報導下留言「Impressive」,隨後旋即宣布xAI的兩萬億參數新模型即將完成初步訓練,「可能超越Kimi」。Kimi官方僅回覆一句「歡迎馬斯克加入2萬億俱樂部」,接著便直接拆了俱樂部大門——當對手還在較量參數規模,月之暗面已把最大規格的模型免費送出。 這顯然不是單純的開源情懷。回顧月之暗面過去一個月的商業動態:六月中旬年度經常性收入(ARR)突破三億美元,其中API收入占比超過七成;七月十九日暫停C端新用戶訂閱;上一輪以兩百億美元估值完成的融資剛交割,新一輪投前估值已喊到三百一十五億美元。仔細的開發者還發現,在Hugging Face上約1.56TB的模型檔案旁,一份僅3.07KB的許可證透露了更多商業盤算。 根據Kimi K3的授權條款,若一家企業經營「模型即服務」(MaaS)業務,且該企業及其關聯方在任意連續十二個月內的合計收入超過兩千萬美元,則在將K3或其衍生模型用於商業目的之前,必須與月之暗面另行簽署協議。這份許可證將K3的討論從技術規格拉回了商業本質。 開放模型長期存在一個尷尬:研發成本由模型公司承擔,雲端服務商卻可能拿走後續營收。若採用MIT授權,雲端廠商可直接下載模型、優化推理、包裝成API,再憑藉既有客戶、算力與銷售渠道收費。模型公司獲得下載量與業界聲量,客戶關係、調用數據與帳單卻留在雲端平台。模型迭代越快,實驗室越容易淪為雲端廠商的上游研發部門。K3的授權條款中明確界定「模型即服務」是指允許第三方對輸入、參數或訓練數據進行實質性控制的服務;將K3能力嵌入自家產品的特定功能,或單純轉發請求至其他平台,則不在此限。換言之,月之暗面並未阻擋一般研發者與多數企業用戶,而是針對下載權重後封裝成API、以自有品牌與定價對外銷售推理服務的雲端廠商與推理平台設下門檻。 海外已有分析人士將此策略與十年前MongoDB、Confluent的經歷相提並論。當年這兩家公司先以寬鬆授權擴大採用規模,等到亞馬遜等雲端廠商將其開源資料庫直接包裝成收費服務,原開發商卻無法抽成,才被迫轉向限制轉售的SSPL、BSL授權。如今K3面對相似的商業挑戰,卻選擇了更溫和的法律路徑:不直接禁止MaaS轉售,而是要求達收入門檻的經營者另行簽約。開放模型產業已從「比誰先開源」「比誰開源得徹底」,進入「比誰能從開放生態中取回定價權」的階段。值得注意的是,同樣在七月釋出權重,智譜GLM-5.2與DeepSeek V4 Pro仍採用乾淨的MIT協議,未加入任何轉售門檻。 若回歸模型本身,K3、DeepSeek、GLM與千問已走上四條不同路線。K3走「大而全」路線:2.8萬億總參數、一百萬token上下文與原生視覺理解能力,官方演示中可從零編寫GPU編譯器、參與晶片設計或生成3D開放世界遊戲;但每百萬token輸入3美元、輸出15美元,單任務平均成本約0.94美元,是四者中最貴。DeepSeek V4 Pro則走相反路徑:總參數1.6萬億,激活參數壓至約490億,輸入與輸出價格分別為0.435美元與0.87美元,單任務成本約0.04美元,並引入峰谷定價,尖峰時段翻倍收費,離峰使用可省一半。智譜GLM-5.2選擇第三條路:採用升級版DeepSeek Sparse Attention,將百萬token上下文的推理開銷壓到通用硬體可承受範圍,單token激活參數約四百億,首字延遲為三者中最短,輸入與輸出價格分別為1.4美元與4.4美元,落於K3與DeepSeek之間,重點爭取編碼與Agent場景的響應速度。阿里巴巴的千問則不追求單點極致,而是追求覆蓋面:支援上百種語言與更完整的多模態能力,更像一套面向企業客戶的通用底座。K3發布三天後,阿里預告Qwen3.8-Max,參數規模2.4萬億,同樣將開放權重。過去一年,開源模型的規模天花板有九個月由Kimi維持,如今旗艦級開放權重已成為中國大模型廠商的標配動作,四條路線無法再用單一維度排座次,「卷參數」正轉向「卷場景」。 更令市場矚目的是跑分與價格的綜合對比。第三方評測機構Artificial Analysis的智能指數榜單上,K3拿下約57分,僅次於Claude Fable 5(約60分)與GPT-5.6 Sol(約59分),Claude Opus 4.8則以約56分緊隨其後。這是首次有開放權重模型將成績拉近至與頂級閉源模型相差兩三分的位置。在Arena前端代碼榜單上,K3上線24小時內衝到第一,超越Claude Fable 5,較前一代進步十七個名次。更關鍵的是,這些接近世界頂尖的成績對應的價格明顯低於多數閉源旗艦:K3單任務平均成本約0.94美元,約為Claude Opus 4.8的一半。若閉源模型的溢價建立在「只有我們能做到這個水平」之上,那麼當開放權重模型將差距壓縮到兩三分,價格卻只有一半左右,這套溢價邏輯便迅速失去說服力。微軟CEO納德拉曾稱此為「反向信息悖論」:買閉源模型等於付了兩次錢,一次付帳單,一次把自己餵給模型的業務知識也送了出去。今年一月紐約法院要求OpenAI交出兩千萬條脫敏用戶對話,更讓企業意識到數據在別人伺服器上便難以掌控,而K3提供的正是「數據不出牆」的選項。 開放權重在此一陣營中已不稀奇,DeepSeek、GLM與千問的旗艦模型早已掛上Hugging Face。K3此番真正帶來新鮮感的反而是權重之外的部分。月之暗面將其快取實作貢獻給vLLM專案,改變了傳統的前綴快取機制;權重上線當天,vLLM與SGLang兩大主流推理引擎同步提供部署方案,AMD團隊完成MI355X晶片的首日適配,雲端平台Modal上線K3託管服務,Inferact則訓練並開源了適配K3的DSpark投機解碼器。vLLM給出的最簡部署配置是八張NVIDIA B300或八張AMD MI355X,皆為尚未大規模鋪貨的頂級資料中心晶片,所需算力遠非個人開發者所能觸及。月之暗面想爭取的不只是「模型更大」的頭條,更希望在推理框架與部署工具鏈中占據位置。權重誰都能開放,但若開發者使用的服務方案、快取實作與投機解碼器都圍繞特定架構開發,更換模型的成本便不只是「換一個檔案」那麼簡單。授權條款中「經由認證推理夥伴使用可豁免轉售條款」的設計,又給了月之暗面一個開關:誰能進入這套生態、誰需要坐下來談判,可由其篩選。放出權重是一次性動作,嵌入工具鏈才能真正留住開發者。 然而自訂規則也有代價。大型企業選擇開放模型時,看重的不只是能力與成本,還包括授權條款的簡單與穩定。MIT與Apache 2.0之所以受歡迎,正因為法務部門容易判斷使用邊界。K3增加了收入門檻、關聯方口徑、MaaS定義與認證夥伴等條件,企業部署前須投入更多合規審查。若GLM、DeepSeek或千問推出能力相近、授權卻更簡單的替代品,平台完全可能繞過K3。開放模型原本就有較低的切換成本,一次發布帶來的技術領先很難長期支撐一套自訂規則。據傳K3.1已在路上,最快下個月就會發布,「開源—驗證—迭代」這套打法可能才剛開始接受市場考驗。
Related
相關文章

國內首個能“飛簷走壁”的具身智能特種機器人亮相,還有“六臂玄甲”
首頁 > 智能時代>具身智能 國內首個能“飛簷走壁”的具身智能特種機器人亮相,還有“六臂玄甲” 2026/7/28 12:54:45 來源:IT之家 作者:汪淼 責編:汪淼 評論: 感謝IT之家網友 很宅很怕生 的線索投遞! IT之家 7 月 28 日消息,“智競未來 —— 首屆智能機器人應用技能大展”發佈活動於今日(7 月 28 日)在北京舉行。該活動由中央廣播電視總檯創新推出,旨在展示智能機器人在工業、服務、醫療康養、應急救援等現實場景中的示範應用技能,推動技術從“實驗室”走向“生產線”。據央視新聞報道,國內首個具身智能特種機器人在發佈活動中亮相。該機器人支持攀爬作業,它可以垂直牆面飛簷走壁,左手打磨、右手焊接,高效協同,集人形雙臂、磁吸爬壁、大模型智能於一體,專攻化工儲罐、船舶、能源設施等大型鋼結構外壁。操作員只需戴上 VR 眼鏡、握住遙控裝置,就能身臨其境地和它一起進行著各種高危作業。報道還提到了擁有六條胳膊的機器人“六臂玄甲”,可同時開工,幹起活來像開了倍速,自帶懂工藝的智能大腦,能根據不同產線靈活分配六臂,以絲級精度同時完成上下料、線纜插拔、螺絲裝配等多項任務,還能替代人幹有害工種。IT之家注意到,這款機器人來自上海颯智智能科技有限公司,該公司官網還展示了四臂具身智能機器人、雙臂具身智能機器人。廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,IT之家所有文章均包含本聲明。 投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:具身智能,機器人小米推出“開箱即用”機器人基座模型 Xiaomi-Robotics-1,基於 10 萬小時數據訓練京東首個 RoboBase 項目落地廣州,打造機器人全生命週期產業基礎設施英偉達在華啟動機器人人才招聘,聚焦具身智能等四大方向2025

藏在大模型背後的新聞人:GPT們的回覆是這樣寫出來的
賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務尋求報道36氪Pro創投氪堂企業入駐創業者服務創投平臺AI測評網 首頁快訊資訊推薦財經AI自助報道安徽最新創投汽車科技專精特新直播視頻專題活動搜索尋求報道我要入駐城市合作藏在大模型背後的新聞人:GPT們的回覆是這樣寫出來的硅谷101·2026年07月28日 12:43他們創造了那些你被AI擊中的瞬間。 過去兩年,光是洛杉磯就蒸發了四萬多個影視崗位。美國的報紙採編崗比2008年少了一半。這些消失的媒體人,有一批去了硅谷的大模型公司,用他們的寫作經驗教AI回答你的問題。每當你感到被大模型的回答擊中內心的時候,寫出來那句話的,就是之前的記者、編輯和紀錄片導演。 本期《硅谷101》播客,我們來聊一聊這個鮮為人知的工種——Content Engineer,內容工程師。我們邀請到兩位從新聞業轉身的資深內容工程師——前媒體人、播客《行星酒館》主播東尼,與NBCUniversal AI戰略總監Bianca Consunji,深入探討:什麼才算“好”的對話,以及如何把它拆解成可量化、可訓練、可評估的工程標準。 我們從這個正在各家AI公司裂變擴張的新興崗位聊起,看看當模型能力逐漸拉平,內容與品味如何成為產品競爭力的關鍵,而懂人文、懂社科的判斷力,又該如何翻譯成工程能用的語言。 以下是這次對話內容的精選: 01 硅谷新職業:內容工程師 軟件工程師讓ChatGPT、Claude這樣的AI擁有了開口說話的能

我國將推動生成式 AI 大模型應用全面支持 IPv6
中國宣布將推動生成式人工智慧大模型應用全面支援 IPv6,中央網路安全和信息化委員會辦公室(中央網信辦)近日聯合北京、上海、浙江、深圳四地網信辦,會同五家頭部大模型企業,在河北雄安新區共同啟動「人工智慧大模型 IPv6 能力提升專項行動」。這項行動旨在為智慧時代的網路基礎設施奠定更穩固的根基,促使生成式大模型應用從底層網路協定層面全面擁抱 IPv6。 IPv6 是由網際網路工程任務組(IETF)設計,用以取代 IPv4 的下一代 IP 協定。

月耗萬億Token:金山辦公為什麼不自己訓練大模型
月耗萬億Token:金山辦公為什麼不自己訓練大模型AGI-Signal2026.07.28 12:18 · 來自江蘇全文3820字00:00 / 11:31面向個人用戶的專業AI助理靈犀,不綁WPS,獨立起跑。金山辦公CEO章慶元在近期舉行的2026金山辦公生產力大會上算了一筆賬:公司內部員工一個月就會消耗數萬億token,其中寫代碼佔去大半,寫文檔和處理辦公事務佔去其餘。

AI越懂你,風險越大:長期記憶為何成為情感大模型的第一道生死線?
AI越懂你,風險越大:長期記憶為何成為情感大模型的第一道生死線?LLMTechWatcher2026.07.28 10:51 · 來自上海全文4512字00:00 / 14:38長期記憶讓情感AI從會聊天走向理解用戶,也帶來過期信息、錯誤畫像、隱私洩露和情感依賴風險。未來的核心競爭力,不是記得更多,而是讓記憶可更新、可糾正、可刪除,並在必要時真正忘記。

AI 外呼日撥千通電話,總檯中國之聲曝光騷擾電話最新營銷手段
首頁 > 智能時代>人工智能 AI 外呼日撥千通電話,總檯中國之聲曝光騷擾電話最新營銷手段 2026/7/28 9:47:59 來源:IT之家 作者:汪淼 責編:汪淼 評論: 感謝IT之家網友 I'm OK 👌、不一樣的體驗 的線索投遞! IT之家 7 月 28 日消息,據中央廣播電視總檯中國之聲今日報道,進入暑期,各類營銷電話頻次持續走高。