中國開源模型三連擊,梁文鋒開最後一槍?

2026年7月28日 15:25
中國開源模型三連擊,梁文鋒開最後一槍?

重點摘要

賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務尋求報道36氪Pro創投氪堂企業入駐創業。

站內 AI 整理稿

中國開源模型領域近期掀起一波密集動態,多家科技公司接連釋出開源大模型,形成業界所稱的「三連擊」態勢。市場目光隨之聚焦於DeepSeek創始人梁文鋒,外界普遍預期他的下一步動作,可能為這輪開源浪潮畫下階段性句點。這場技術競賽不僅展現中國AI圈的研發實力,更反映開源與閉源路線之爭正加速收斂,而梁文鋒的選擇將直接影響後續產業格局。 DeepSeek此前以極低成本訓練出效能逼近GPT-4的模型,令全球矚目。這家新創公司由梁文鋒主導,憑藉精簡的架構與高效的訓練方法,在資源遠不如美國科技巨頭的情況下,交出令人驚豔的成績單。如今,當其他中國廠商紛紛跟進開源策略,梁文鋒是否會推出更具顛覆性的版本,成為業界最熱烈的猜測。 若梁文鋒果真出手,市場預期他可能透過更先進的模型架構或訓練技術,進一步拉高開源模型的性能天花板。這不僅將為中國開源模型的「軍備競賽」定調,也將考驗其他廠商後續的技術迭代能力與商業化策略。畢竟,開源模型雖然能快速累積社群聲量,但如何從中獲利、維持長期研發投入,仍是所有參與者必須面對的課題。 回顧這波「三連擊」的開端,多家中國科技公司幾乎在同一時間點宣布開源自家大模型,形成一股集體聲勢。這些模型涵蓋不同參數規模與應用場景,從語言理解到影像生成,展現出中國AI生態的多元性。市場解讀認為,這背後既有技術研發的自然產出,也有應對國際競爭、爭取開發者社群支持的戰略考量。 開源與閉源的爭論在中國AI圈由來已久。過去幾年,百度、阿里等巨頭傾向閉源,將模型作為商業服務提供;而新創公司如DeepSeek則選擇開源,試圖以技術開放換取影響力。如今,隨著開源模型在性能上逐漸追趕閉源方案,不少企業開始重新評估路線。這波三連擊,正是技術與商業邏輯交織下的結果。 梁文鋒的DeepSeek之所以備受關注,關鍵在於其「低成本高效能」的典範。該公司以遠低於業界主流的訓練成本,打造出能力驚人的開源模型,甚至讓部分美國研究機構也感到震撼。這種「以小博大」的模式,讓中國AI開發者看到另一種可能性:不需要動輒數億美元的算力投入,也能在關鍵領域取得突破。 然而,開源模型的競爭也帶來新的挑戰。當越來越多的模型免費釋出,企業如何差異化?商業模式如何建立?部分廠商選擇將開源模型作為入口,後續透過雲端服務、企業級解決方案獲利;另一部分則寄望於開源社群的貢獻,加速模型迭代。梁文鋒若在此時推出新版本,很可能會進一步壓縮其他人的策略空間。 業界觀察人士指出,這波開源浪潮的收斂點,或許正是中國AI產業從「量變」走向「質變」的關鍵時刻。過去幾年,中國AI界在模型數量上快速增長,但真正具備全球影響力的開源項目仍屬少數。梁文鋒的下一步,可能決定未來半年到一年內,中國開源模型的話語權歸屬何方。 除了技術層面,市場也關注政策與資金環境的變化。中國政府對AI發展給予高度支持,但開源模型涉及資料安全、演算法監管等議題,各廠商必須在開放與合規之間取得平衡。梁文鋒若推出新模型,勢必也得考慮到監管要求,這對其技術設計與發布策略構成潛在影響。 從更宏觀的角度看,中國開源模型的崛起,正在重塑全球AI競爭版圖。過去美國科技巨頭主導開源生態,如今中國廠商開始嶄露頭角,甚至在某些領域實現反超。DeepSeek的案例證明,高效率的訓練方法可以彌補算力劣勢,這為其他開發中國家與新創團隊提供了參考路徑。 梁文鋒本人對外發言一向低調,但從DeepSeek過往的技術報告與論文來看,其團隊在模型壓縮、注意力機制最佳化等領域有深厚積累。如果這些技術進一步升級,並整合到新的開源版本中,或許能再次改寫性能與成本的比值。業界正屏息等待,看這位「開源顛覆者」是否會扣下最後一槍。 無論最終結果如何,這波三連擊已經讓中國AI開源社群更加活躍。開發者獲得了更多選擇,企業得以用更低成本導入先進模型,而學術研究也能基於開源成果快速推進。梁文鋒的動向,就像一個訊號燈,將影響後續的投資方向與研發資源配置。 短期內,市場預期DeepSeek可能在近期釋出重大更新,甚至可能是一個全新的模型系列。這不僅是對技術實力的展示,也是對開源理念的再一次驗證。如果新模型能在性能上超越當前所有開源方案,甚至接近閉源頂尖水準,那麼中國開源模型將真正站上世界舞台中心。 然而,開源並非萬靈丹。梁文鋒若成功推出顛覆性版本,其他廠商可能面臨更嚴峻的追趕壓力,甚至被迫調整策略。部分業者可能轉向垂直領域的專用模型,或加強與硬體廠商的合作,以尋求差異化。這場開源與閉源的博弈,最終將回歸到技術本質與商業永續性。 總體而言,中國開源模型的三連擊,已經為2025年的AI產業寫下一個重要註腳。梁文鋒是否會成為那個「終結者」,時間會給出答案。但可以確定的是,無論他是否出手,開源路線已在中國站穩腳跟,並將持續影響全球AI發展的走向。

Related

相關文章

IT之家模型更新

阿里雲 Qoder 上線實時語音交互智能體 QoderVoice,支持討論式交互

首頁 > 智能時代>人工智能 阿里雲 Qoder 上線實時語音交互智能體 QoderVoice,支持討論式交互 2026/7/28 16:14:49 來源:IT之家 作者:遠洋 責編:遠洋 評論: 感謝IT之家網友 Domado 的線索投遞! IT之家 7 月 28 日消息,今日,阿里雲 Qoder 上線實時語音交互智能體 QoderVoice,由全雙工語音模型 Qwen-Audio-3.

剛剛
IT之家模型更新

LM Studio Bionic 智能體工具新增月之暗面 Kimi K3 模型支持,定價方案公佈

LM Studio 旗下 Bionic 智能體工具近日宣布,正式支援月之暗面(Moonshot AI)最新開源的 Kimi K3 大模型。該模型擁有 2.8 萬億參數,並提供高達 100 萬 token 的上下文窗口,能夠處理極為龐大的文本內容。目前服務託管於美國伺服器,開發者與企業用戶可直接透過 Bionic 平台調用此模型,無需自行部署基礎設施。

剛剛
智東西模型更新

榮耀Robot Phone把拍攝玩出花,聯手阿萊,復刻好萊塢級運鏡

智東西(公眾號:zhidxcom) 作者 | ZeR0 編輯 | 漠影 智東西7月28日報道,今日,榮耀發佈機器人手機Robot Phone的核心影像技術能力,提出影像演進底層規律“光智進化律”,首度展示與全球電影工業標杆阿萊(ARRI)合作的電影級影像技術路徑,在移動終端搭建專業電影級影像技術體系。 “光智進化律”的公式是:影像體驗 = 光學能力 ^ 智能能力。

剛剛

Kimi K3 開源:2.8 萬億參數的門檻與紅利

月之暗面開源全球最大權重Kimi K3,擁有2.8萬億參數,硬體門檻極高,僅機房級別可運行,但透過Modified MIT許可證和MoE架構,雲廠商與生態夥伴可快速接入,將改造權下放給小B端。雖然個人開發者短期無法直接受益,但產業鏈分層傳導有望讓中小企業最終獲得選擇權與定價權。

剛剛
IT之家模型更新

ESP32-AI 亮相:8MB PSRAM 運行 2890 萬參數模型,設想離線調配出最佳咖啡

首頁 > 智能時代>人工智能 ESP32-AI 亮相:8MB PSRAM 運行 2890 萬參數模型,設想離線調配出最佳咖啡 2026/7/28 12:03:00 來源:IT之家 作者:故淵 責編:故淵 評論: IT之家 7 月 28 日消息,科技媒體 Tom's Hardware 昨日(7 月 27 日)發佈博文,報道稱烏克蘭開發者 Slava S 發佈 ESP32-AI 項目,針對樂鑫(Espressif)的 ESP32-S3 開發板,成功部署 2890 萬個參數的本地 AI 模型。IT之家注:ESP32-S3 開發板由樂鑫推出,配備 512KB 的 SRAM(片上高速存儲,訪問週期僅需 1 個 CPU 時鐘)、8MB 的 PSRAM(通過 SPI 總線擴展的 8MB 內存,訪問速度取決於 SPI 時鐘配置)和 16MB 的閃存,由於內存容量受限,此前 Dave Bennett 針對該開發板部署 AI 參數上限為 26 萬個。Slava S 採用 Google Gemma 使用的 P er-Layer Embeddings(分層嵌入)技術。模型經過 4-bit 量化後,文件大小為 14.9MB。開發者把 25M 參數嵌入表存入 16MB 閃存。模型每生成 1 個 Tokens,只需讀取嵌入表中的少量數據。在使用場景方面,ESP32-S3 開發板雖然成功部署 2890 萬個參數模型,但無法支持聊天或者編程,不過開發者提出離線咖啡機應用設想。該設備可以圍繞咖啡豆、研磨方式、配比和水溫生成內容。廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,IT之家所有文章均包含本聲明。 投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:AIAitver 推出 ESP32-C3 開發板:集成 0.

剛剛