楊植麟終於追上梁文鋒了

重點摘要
# 杨植麟终于追上梁文锋了:中国开源大模型双雄格局初成 2026年7月30日,一则消息引爆了全球AI圈——月之暗面(Kimi)正式开源了K3模型权重。这个拥有2.8万亿总参数、性能接近全球最顶级模型Claude Fable 5的大模型,以完全免费下载、本地部署、自由商用的姿态,向世界展示了中国AI力量的又一次跃升。 这不仅仅是一次技术发布。它标志着中国两大独立大模型公司——DeepSeek和Kimi——在技术与影响力的赛道上,终于站到了并肩的位置。
# 杨植麟终于追上梁文锋了:中国开源大模型双雄格局初成
2026年7月30日,一则消息引爆了全球AI圈——月之暗面(Kimi)正式开源了K3模型权重。这个拥有2.8万亿总参数、性能接近全球最顶级模型Claude Fable 5的大模型,以完全免费下载、本地部署、自由商用的姿态,向世界展示了中国AI力量的又一次跃升。 这不仅仅是一次技术发布。它标志着中国两大独立大模型公司——DeepSeek和Kimi——在技术与影响力的赛道上,终于站到了并肩的位置。杨植麟,这位90后创业者,用K3证明了自己能够追赶甚至比肩梁文锋的成就,也引发了硅谷新一轮的恐慌与反思。 ## 硅谷的“中国开源风暴”
“DeepSeek、Qwen、Kimi,美国和硅谷已经快经不起中国开源大模型的连环暴击了。Sad。”这句话在海外科技圈广为流传,背后是实实在在的产业震动。7月27日深夜,Kimi K3的发布如同一颗深水炸弹。在Artificial Analysis智能指数上,K3排名全球第三,仅次于Claude Fable 5和GPT-5.6 Sol;在Frontend Code Arena编程榜单上,它以1679分登顶,超越所有闭源模型。通过KDA混合线性注意力、Attention Residuals等架构创新,K3用远少于OpenAI、Anthropic的算力和资金,训练出了接近它们水平的模型。
更令硅谷不安的是开源策略。K3开放了全部权重,意味着任何人都可以下载、检查、修改并在自己的设备上运行。AI创业者们欢呼雀跃,“他们永远也夺不走我的Fable 5”了,Kimi K3成为了他们的替代方案。这种开放权重的模式,本质上是在解构美国的技术霸权——不是通过禁运,而是通过生态的扩散。这已经不是第一次了。2025年1月,DeepSeek发布R1并同步开源权重,Meta的生成式AI团队甚至成立四个“战情室”专门研究它。随后阿里巴巴的Qwen引发了“Qwen Panic”,几乎所有人都开始用它。如今Kimi K3的到来,让摩根大通直呼这是“DeepSeek 2.0时刻”。
黄仁勳甚至为此紧急开通X账号,发布公开信力挺中国AI。《开放权重与美國AI領導力》一文中,他直言反对封禁中国大模型,因为开源模型“降低了AI使用门槛,扩大了整体市場,带动了芯片、算力需求”。老黄的逻辑非常清楚:封锁没有用,反而会让市场萎缩。中国团队在算力紧缺之下,做出了逼近全球最强闭源模型的产品,这本身就是对封锁政策最有力的反驳。## 从“失意”到“扬眉吐气”
一年的时间,足以改写一个人的命运。2024年,杨植麟的月之暗面曾风光无限。凭借首个支持200万汉字长上下文的Kimi Chat,加上疯狂的投流策略,月之暗面拿下了3600万用户,在國內僅次於豆包。然而,2025年初,DeepSeek R1的横空出世彻底改变了局面。R1出色的推理表现引发了全民追捧,Kimi和一眾大模型公司相形见绌,用户用脚投票,迅速流失。一边是梁文鋒被捧上神坛,冠以“梁聖”之名,受邀参加民企座谈会;另一边则是杨植麟和Kimi深陷困境,甚至有人认为他们快要活不下去了。至暗时刻,杨植麟做出了一个艰难的決定:砍掉多余业务,全力研发基座模型和Agent。这个选择最终证明是正确的。
今年春节后,Kimi接连推出K2、K2.5,表现步步提升,直到K3彻底爆发。K3的成功不仅是技术层面的突破。它证明了在中国算力受限的条件下,通过架构创新和工程优化,依然能够训练出世界顶级模型。这与DeepSeek去年冲击硅谷的逻辑如出一辙——不是靠算力堆砌,而是靠智慧破局。## 双雄格局:技术、资本与巨头的博弈
随着K3的发布,杨植麟和梁文鋒这两位中国AI领域的标志性人物,终于站在了接近的位置。技术之外,两家公司也走在资本化的競速路上。月之暗面背后站着阿里。2024年,阿里向Kimi投资约8亿美元,购入约36%股权,经过多轮融资稀释后,預計当前仍持有20%以上,是最大机构股东。DeepSeek的靠山则是腾讯——今年梁文鋒打开融资大门后,腾讯出资100亿元成为第二大股东。某种程度上,两人的赛跑也是DeepSeek-腾讯阵營和Kimi-阿里阵營的竞争。估值方面,两家公司都已经达到500亿美元级别。
月之暗面计划8月启动Pre-IPO轮融资,目標投前估值500亿美元,半年之内从43亿到500亿美元,上涨超过10倍。DeepSeek方面,首轮融资超500亿人民币,估值同样突破500亿美元,有消息称第二輪融資目標估值約710亿美元。上市节奏上,市场预计Kimi最快6个月内将登陆香港资本市场,比DeepSeek先行一步。但杨植麟与循环智能股东之间的仲裁仍未了结,红筹/VIE架构拆除也在进行中,这些都会影响上市时间窗。DeepSeek方面股权仍高度集中,梁文鋒直接持股34%,最终受益股份约81.65%,控制的投票权超过80%,不符合上市公司的股权特征,预计IPO不会太快。## 繁荣背后的隐忧
在欢呼声中,Kimi K3也面临着诸多争议。API定价过高、稳定性不足等问题被用户频繁吐槽。更值得关注的是,Kimi在7月19日宣布暂停C端新用户订阅,优先保障现有付费用戶算力——这暴露了算力瓶颈的现实困境。 频繁更新模型背后,融资和上市的冲勁也显而易见。2025年底,杨植麟还在全員信中写道“我們短期不著急上市”,但转年火爆的二級市場和焦慮的投資人彻底打乱了他的节奏。以模型性能为核心的估值体系其实非常脆弱——智谱因为K3的发布股价暴跌就是一个警示。长期而言,大模型公司们还必须证明自己的收入和盈利能力。 ## 世界格局的重塑
这场竞争的意义早已超越了技术和商业层面。一名中国90后创业者,卡内基梅隆大学博士毕业,拒绝谷歌、苹果邀约回国创业,开发出顶级模型,对OpenAI、Anthropic、谷歌三家闭源巨头说“我免费”——这样的故事本身就具有时代标志性。开源社区已经有人开始喊“杨圣”,带着调侃,也带着敬意。正如梁文锋所言,AI市场足够广阔,商业化可以做得非常大,完全可以容纳两家公司。更重要的是,他们两人——一个从量化金融跨界而来,一个从学术象牙塔坚决出走——用自己独特的方式,证明了在美国算力封锁下,依然可以跑出优秀、领先的模型。美国白宫科技政策办公室负责人公开指控月之暗面,声稱Kimi K3涉嫌違反出口管制。
但这种指控恰恰暴露了封锁政策的无力。中国公司不仅在追赶,还在重新定义游戏规则——开放权重让任何人可以下载、检查、修改、在自己的设备上运行,这不再是芯片买不买得到的问题,这是生态的问题。当梁文锋和杨植麟的名字被并列提及,当“梁圣”和“杨圣”的称呼在大洋两岸流传,这不仅仅是个人的荣耀。这是中国AI走向世界舞台中央的注脚,是全球AI竞争从单极走向双极的转折。正如文章所说,2026年的这个夏天,杨植麟终于追上梁文锋了。这不是终点,只是一个赛点。全球AI,中美双线叙事已经开启。而这一切,才剛剛開始。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
騰訊雲開源 TencentDB Agent Memory v2.0:專為 AI 編碼代理打造的團隊級記憶中樞
Tencent Cloud has open-sourced TencentDB Agent Memory v2.0, a team-level memory hub for AI agents. The idea is super simple: if project context was already explained once, a new session should not need it repeated.
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。