20個關鍵詞,串起梁文鋒四小時分享

重點摘要
DeepSeek完成約510億元人民幣首輪融資,投後估值約4185億元,並籌備最快今年提交IPO申請。創辦人梁文鋒在四小時分享中強調,團隊穩定性是核心利益,持續學習是下一代AI模型關鍵,並認為中國AI將因成本優勢在全球扮演產量最大角色。
DeepSeek 近日完成成立以來首輪融資,規模約 510 億元人民幣,投後估值達 4185 億元。創辦人梁文鋒個人出資約 200 億元,投資方涵蓋騰訊、寧德時代體系、京東、網易、IDG 資本等機構。與此同時,多家媒體報導指出,DeepSeek 已開始籌備在中國內地 IPO,最快可能於今年提交上市申請,並計劃在 2027 年完成上市。在近期一場投資者交流會上,梁文鋒進行了近四小時的分享,詳細闡述 DeepSeek 的組織文化、開源邏輯、技術路線以及對 AI 產業競爭的判斷。以下從他的談話中梳理出幾個核心面向。梁文鋒認為,管理一家大公司不能只靠規章制度,而是靠願景。
願景不是掛在牆上的標語,而是實際運作的方式。他強調「克制」是一種戰略,有時捨棄某些東西才能換取更多價值。DeepSeek 只專注於 AGI 的主線,對於 3D、影片生成等領域,他認為與智能主線關聯不大,因此不會投入。他判斷,世界模型與智能並非當前最重要的課題,當前最關鍵的是 AI 訓練,以及訓練後如何解決持續學習問題。持續學習被梁文鋒視為下一代模型的核心能力。他指出,必須具備持續學習能力,才能稱之為下一代模型。在此之前,DeepSeek 能做的就是降低成本、提升效果與速度。但若要實現重大突破,模型必須能持續學習。一旦持續學習做出來,通用智能可能就會變得容易,因為可以用它來實現。
反之,若靠人工去打造通用智能,會是數據密集、人力密集且性價比低的工作。梁文鋒直言,DeepSeek 最大的核心利益是維持團隊穩定,這甚至是唯一的核心利益。只要團隊穩定,他認為一定能實現 AGI。在管理上,公司採取從上而下與從下而上雙線並行。從下而上,每個人可以自主決定想做的事,沒有 KPI 束縛;公司整體建立在共識基礎上,梁文鋒的權威與影響力也來自共識,而非單方面決策。談到資源,梁文鋒表示,在可承受的範圍內,自然是越多越好。DeepSeek 的策略是在合理價格內盡可能購買更多顯示卡。他堅信 Scaling 法則,規模越大效果越好,能解鎖更多功能。
目前阻礙 Scaling 的並非意願,而是算力不足。他坦言,訓練大型模型並非因為認為這樣就夠了,而是剛好有這麼多資源,只能根據資源來決定模型規模。關於晶片,梁文鋒認為國產 AI 晶片的硬體與生態都沒有問題,唯一問題是產能不足。國產卡在適配上沒有障礙,英偉達無法阻擋。在正常商業環境下,若能買到英偉達卡,國產替代會比較困難;但若英偉達卡買不到,所有人都被迫轉向國產晶片。他認為英偉達此舉是在自掘墳墓。他更指出,華為的 950 超節點在性能與價格上能完全平替英偉達的 GB200、GB300。對於未來五年,他不太相信還會卡在產能問題上,雖然今年、明年、後年可能仍受產能限制,但他對五年後持樂觀態度。
在全球化 AI 分工中,梁文鋒認為中國公司很可能扮演產量最大的角色。因為中國產能最大,包括晶片與電力,且中國人擅長將產品做到最便宜,再在效果上發力。他預測未來 AI 也可能如此,中國產 AI 價格會系統性偏低,與其他行業中國提供的服務更便宜類似。他歸納最終差距會體現在三方面:成本、時間、使用者體驗,除此之外沒有太大差距。梁文鋒提出「少即是多」的觀點,認為拿得多的人會被拿得少的人打敗。即使只是願景上的「拿得多」,也會先輸,面臨更大困難。對於多模態,梁文鋒表示一直在佈局,對 C 端產品很重要,但對智能上限而言只是組件,不是主線本身。
DeepSeek 預計會推出支援原生多模態的 V4 及後續版本,但不會將其視為智能本身。關於開源,梁文鋒說一開始就想得很清楚。首先是基於願景,其次是認為開源對商業化有好處。雖然歷史上開源與商業化常有衝突,但他認為 AI 這個領域足夠大,最終可能佔到人類社會 GDP 的百分之十,不可能獨佔,必須與人分享,否則無法生存。他強調,DeepSeek 內部很多人抱持「責先利後」的想法:首先要對自己有用,自己好用通常意味著別人也會好用,但前提是保證自己好用,這樣開發下一版模型時才會更快。數據方面,梁文鋒透露公司目前有一半的核心研究員在標註數據。他認為,解決 AI 問題在現階段靠的就是標註數據。
商業化方面,他表示 DeepSeek 本質上仍是公司,只是在考慮賺哪些錢、何時賺錢、賺多少錢、靠什麼賺錢上有取捨。他認為許多公司之所以偉大,是因為有利潤以外的追求,而這個追求最終不但不會影響商業化,反而能讓商業化做得更好。梁文鋒的四小時分享,勾勒出 DeepSeek 在巨額融資後的戰略輪廓:堅守 AGI 主線、重視團隊穩定、以開源和持續學習為核心、務實看待資源限制,並對中國在全球 AI 供應鏈中的角色抱持信心。隨著 IPO 計畫推進,這家公司的下一步動向勢必受到市場高度關注。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。