Kimi K3 開源:2.8 萬億參數的門檻與紅利

2026年7月28日 13:52
Kimi K3 開源:2.8 萬億參數的門檻與紅利

重點摘要

月之暗面開源全球最大權重Kimi K3,擁有2.8萬億參數,硬體門檻極高,僅機房級別可運行,但透過Modified MIT許可證和MoE架構,雲廠商與生態夥伴可快速接入,將改造權下放給小B端。雖然個人開發者短期無法直接受益,但產業鏈分層傳導有望讓中小企業最終獲得選擇權與定價權。

站內 AI 整理稿

月之暗面於 7 月 27 日將 Kimi K3 的完整權重上傳至 Hugging Face,採用 Modified MIT 許可證,參數規模高達 2.8 萬億。這項開源動作在業界引發廣泛討論,但值得注意的是,就在一週前(7 月 20 日),該公司才因算力緊張暫停了 C 端新用戶的訂閱服務。C 端用戶激增導致集群不堪負荷,同時間卻釋出全球最大的開源權重,兩件事看似矛盾,實則反映月之暗面兩條截然不同的商業路徑:C 端走 API 調用收費,開源則意在出售產業鏈改造權。 打開 Hugging Face 上的 Kimi K3 頁面,594GB 的權重檔案靜靜躺在那裡。多數人或許會因硬體門檻而直接關閉分頁,但這篇文章指出,真正能從中獲利的買家,正是那些跑不動這組模型的人。 K3 的硬體需求極其驚人。在 MXFP4 量化後,模型大小約為 594GB,需要 8 張 H100 80GB 顯示卡才能勉強將模型載入顯存,而在推論過程中,KV 快取與激活值還會進一步撐爆顯存,生產級場景通常需要 64 張以上的 H100 組成超節點,硬體成本從百萬美元起跳。單張 RTX 4090 連 K3 的一個專家模組都塞不下。相比之下,Llama 4 最小的 7B 版本能在筆記型電腦上運行,DeepSeek V4 的 490B 活躍參數用幾張消費級顯示卡也能折騰。K3 的 2.8 萬億參數直接把門檻拉高到機房等級,普通人、小團隊甚至大部分中型企業都被擋在門外。 然而,雲端廠商與軟體服務商才是直接買家,最終獲益的則是小型 B 端企業與垂直團隊。開源當天,Together AI、Modal 等海外平台隨即宣布 day-0 接入;國內業者反應更快,騰訊雲 ADP、TokenHub、阿里雲百鍊、國家超算互聯網,甚至值得買科技的 OpenHubs,都在第一時間上線了 K3 的調用通道。小 B 端不再需要自行購買 H100 或租用機房,只需透過雲端廠商的 API 就能使用 2.8 萬億參數的基座模型。 過去只有月之暗面官方提供 K3 的 API 服務,定價權完全掌握在廠商手中;如今多家雲端廠商同步託管,相當於出現多個供貨渠道,長期來看定價不會被單一廠商鎖死。Modified MIT 許可證是另一把關鍵鑰匙,它允許商用、修改與再分發,與 AGPL 那種強制開源的條款截然不同。商業公司可以基於 K3 開發閉源的行業定製模型,無需公開自身業務代碼,這是閉源 API 永遠無法提供的權利。 K3 採用稀疏專家架構(MoE),理論上支援選擇性蒸餾。未來社群可能只蒸餾高頻激活的專家子集,做出單卡可跑的「K3 學生模型」,幾個月後或許會出現 70B 甚至 7B 的蒸餾版本。這只是基於架構開放後的產業預期,目前尚未實現。 DeepSeek 走過相似的路線。V4 正式版透過峰谷定價與 Flash/Pro 雙檔位,將 API 成本壓到業界最低,Flash 緩存未命中輸入價僅 0.14 美元,Pro 版也遠低於均價。兩者底層邏輯一致:用開放權重換取生態規模,靠生態規模攤薄單位成本,最終透過 API 服務與商業解決方案變現。做公益或讓人人本地部署,從不是最終目的。不過 K3 不會完全複製 DeepSeek 的價格戰路線,後者靠極低的激活參數實現極致性價比,K3 則主打前沿性能,短期內成本很難降到同等水準。它的價值在於將前沿性能級的改造權下放給市場。 硬體門檻絲毫未降,降的是改造門檻。這套紅利透過產業鏈分層傳遞:雲端廠商扛起算力,微調團隊負責場景落地,蒸餾生態降低門檻,最終傳導到小 B 端。個人開發者今天或許還吃不到肉,但遊戲規則已經改變。 對比閉源與開源模型,小 B 端多了哪些選擇?閉源模型只有 API 一條路,價格由大廠決定,定製只能靠提示詞,天花板明顯。開源模型則提供 API、微調、蒸餾、自託管四條路,企業可根據預算與技術能力選擇最適合的模式。不過別太興奮,K3 API 官方定價為輸入 3 美元、輸出 15 美元,緩存命中僅 0.30 美元。月之暗面表示,在程式設計場景下緩存命中率可超過 90%,意味著重度用戶的實際輸入成本約為標價的十分之一。對高頻調用的小 B 端來說,這不算白菜價,但也非天價。然而月之暗面自身算力緊張,API 供應還不穩定,雲端廠商託管價格也未見大規模競價降價。 K3 開源給出的是一張期貨合約,其兌付依賴開源協議持續寬鬆、雲端廠商算力供給充足、社群生態持續活躍。若後續海外針對中國開源模型出台限制政策,海外託管與生態的傳導也會先受阻。任何一個環節收緊,中小企業的選擇權都會快速縮水。 2.8 萬億參數本身不是為小團隊準備的,但基於它生長出來的生態,最終會傳導到小團隊手中。今天還無法完全兌現,但改造權已經下放。真正的變化在於規則本身改變了。以前閉源大廠一手攥著模型、一手定著價格,小 B 端連議價、定製的資格都沒有;現在 K3 把模型改造權扔到了牌桌上。即使暫時買不起入場籌碼,這場遊戲的定價權,已經不再只掌握在少數幾家業者手中。跑不起它的人,才是最終買家。

Related

相關文章

IT之家模型更新

阿里雲 Qoder 上線實時語音交互智能體 QoderVoice,支持討論式交互

首頁 > 智能時代>人工智能 阿里雲 Qoder 上線實時語音交互智能體 QoderVoice,支持討論式交互 2026/7/28 16:14:49 來源:IT之家 作者:遠洋 責編:遠洋 評論: 感謝IT之家網友 Domado 的線索投遞! IT之家 7 月 28 日消息,今日,阿里雲 Qoder 上線實時語音交互智能體 QoderVoice,由全雙工語音模型 Qwen-Audio-3.0-Realtime 驅動。用戶可隨時語音喚醒智能體,通過語音下達指令、討論方案,智能體實時響應並執行任務。IT之家附官方詳細介紹如下:語音指令與任務執行同步進行用戶在 Qoder Quest 模式主界面點擊語音入口,即可在任意界面喚起語音助手懸浮窗。發起語音指令後,Qoder 自動創建任務、調用工具並在後臺執行。用戶無需停留頁面等待結果,對話過程中可隨時打斷、追問或調整需求。支持討論式交互,複雜任務可多輪協商面對複雜任務,Qoder 會先給出執行方案,用戶通過語音補充需求或調整方向,Qoder 根據反饋優化並執行。例如用戶說“幫我重構這個模塊”,Qoder 給出多個方案後,用戶進一步提出“方案 B 更好,但要加上緩存”,Qoder 會立即調整並繼續執行。已登陸 Qoder 國際版,提供 3 天免費試用Qoder Voice 已登陸 Qoder 國際版,首批開放給個人訂閱、個人體驗版和企業訂閱用戶,提供 3 天限時免費試用。Qoder CN 版將於近期上線。廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,IT之家所有文章均包含本聲明。 投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:Qoder,阿里雲,QoderVoice阿里:Qoder Mobile 移動端 App 安卓、iOS、鴻蒙三大版

剛剛
智東西模型更新

榮耀Robot Phone把拍攝玩出花,聯手阿萊,復刻好萊塢級運鏡

智東西(公眾號:zhidxcom) 作者 | ZeR0 編輯 | 漠影 智東西7月28日報道,今日,榮耀發佈機器人手機Robot Phone的核心影像技術能力,提出影像演進底層規律“光智進化律”,首度展示與全球電影工業標杆阿萊(ARRI)合作的電影級影像技術路徑,在移動終端搭建專業電影級影像技術體系。 “光智進化律”的公式是:影像體驗 = 光學能力 ^ 智能能力。

剛剛
IT之家模型更新

ESP32-AI 亮相:8MB PSRAM 運行 2890 萬參數模型,設想離線調配出最佳咖啡

首頁 > 智能時代>人工智能 ESP32-AI 亮相:8MB PSRAM 運行 2890 萬參數模型,設想離線調配出最佳咖啡 2026/7/28 12:03:00 來源:IT之家 作者:故淵 責編:故淵 評論: IT之家 7 月 28 日消息,科技媒體 Tom's Hardware 昨日(7 月 27 日)發佈博文,報道稱烏克蘭開發者 Slava S 發佈 ESP32-AI 項目,針對樂鑫(Espressif)的 ESP32-S3 開發板,成功部署 2890 萬個參數的本地 AI 模型。IT之家注:ESP32-S3 開發板由樂鑫推出,配備 512KB 的 SRAM(片上高速存儲,訪問週期僅需 1 個 CPU 時鐘)、8MB 的 PSRAM(通過 SPI 總線擴展的 8MB 內存,訪問速度取決於 SPI 時鐘配置)和 16MB 的閃存,由於內存容量受限,此前 Dave Bennett 針對該開發板部署 AI 參數上限為 26 萬個。Slava S 採用 Google Gemma 使用的 P er-Layer Embeddings(分層嵌入)技術。模型經過 4-bit 量化後,文件大小為 14.9MB。開發者把 25M 參數嵌入表存入 16MB 閃存。模型每生成 1 個 Tokens,只需讀取嵌入表中的少量數據。在使用場景方面,ESP32-S3 開發板雖然成功部署 2890 萬個參數模型,但無法支持聊天或者編程,不過開發者提出離線咖啡機應用設想。該設備可以圍繞咖啡豆、研磨方式、配比和水溫生成內容。廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,IT之家所有文章均包含本聲明。 投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:AIAitver 推出 ESP32-C3 開發板:集成 0.

剛剛

2.8萬億參數之後,硅谷為何重新“站隊”開源

英偉達創辦人黃仁勳在7月24日發布了他的第一則X平台貼文,轉發了一封名為《開放權重與美國AI領導力》的公開信。這封公開信最初由英偉達、微軟、Meta、IBM等25家機構聯名,隨後迅速擴增至約50家,包括OpenAI、谷歌、AMD、思科、Cloudflare與GitHub等企業陸續加入。在美國主要的前沿模型公司中,Anthropic成為唯一一家仍未簽署的企業。 黃仁勳在配文中僅簡短寫道:「世界既需要前沿閉源模型,也需要前沿開放模型。

剛剛