爆料稱 DeepSeek 下一波大模型將至:3 萬億參數,性能劍指 GPT-6 Astra

AI資訊AI新聞資訊正文爆料稱 DeepSeek 下一波大模型將至:3 萬億參數,性能劍指 GPT-6 Astra發佈於AI新聞資訊發佈時間 :2026年9月14號 14:16閱讀 :1分鐘本週 DeepSeek 發佈了 V4.1 Flash,這個大模型架構變化之大,完全可以稱得上是 V5,但 DeepSeek 很低調地沒有更換大版本號。Pro 系列的新品已確定為 V4.1 Pro,具體升級尚未公佈;如果是 V4 到 V4.1 這樣的提升幅度,V4.1 Pro 的性能上限也會很高,但考慮到此前 V4 Pro-0813 正式版不及預期,外界期待值不宜拉得太高。DeepSeek Code 2.
0 被指即將發佈,主打電腦控制據爆料,後續還有一波大模型,名為 DeepSeek Code 2.0,即將在 9 月份發佈,預計性能會擊敗 Mythos 5.1 和 GPT-6 Astra——這是當前最強大的兩個前沿級大模型。其他方面,DeepSeek Code 2.0 預計將繼續保持開源開放,設計重點是 Computer Use,也就是電腦控制:讓 AI 替代用戶操作電腦完成大量工作,Astra 目前許多令人驚訝的表現正來自這一能力。3 萬億參數,國內最強規模爆料稱該模型擁有高達 3 萬億以上的參數量,顯然這也是它提升性能的關鍵。作為對比,國內目前最強的是 K3 大模型的 2.
8 萬億參數,千問 Qwen 3.8 Max 為 2.4 萬億參數,DeepSeek V4 Pro 為 1.6 萬億參數。從 V4.1 Flash 換用新結構使參數量翻倍來看,Code 2.0 從當前 1.6 萬億提升到 3 萬億參數的可信度是有的——想與 Mythos 5.1 及 Astra 這樣的大模型競爭,就需要這個級別的參數量,否則性能上限很難提升。不過這一爆料的可信度尚難判斷。DeepSeek 在 2023 至 2024 年曾推出過三款名字帶 Code 的大模型,當時表現平平;這次若重推偏向代碼 / 邏輯的 Code 大模型、作為旗艦級產品,也不失為一個方向,讓 V4.
1 Pro 及 Flash 面向通用 Agent 任務即可。相關推薦DeepSeek 傳聞將推 3 萬億參數 Code 2.0,劍指 GPT-6 AstraDeepSeek近期動作密集:本週低調發布V4.1 Flash,雖未調整大版本號,但底層架構升級幅度已達V5級別;後續還將推出全新大模型Code2.0及V4.1 Pro系列,其架構換代與新品路線引發行業關注。2026年9月14號 10:01152.7kDeepSeek 三種模式合一:V4.
1 Flash 最快今日發佈,V4 Pro 將下線DeepSeek將快速、專家、識圖三模式合併為統一智能模式,無需手動切換,可自動判斷查詢複雜度、識別圖片並激活視覺能力,按任務難度調配處理。此前多模態模型V4-Flash-Vision-Exp已上線API,支持三種調用格式;V4.1 Flash性能全面超越V4 Pro。2026年9月10號 10:55390.7k衝擊科創板!DeepSeek 傳已聘請中信證券籌備年內 IPO,估值劍指 5000 億DeepSeek已聘請中信證券籌備科創板上市,計劃年內遞交IPO申請、明年掛牌。
募資將主要用於擴大算力基礎設施、加大前沿大模型與芯片自研投入,並強化核心研發人才激勵。2026年9月9號 15:38226.7kDeepSeek 宣佈 Flash 系列模型降價:輸出降至每百萬 Token 4 元DeepSeek宣佈自2026年9月10日12時起調整Flash系列模型價格:空閒時段輸入緩存命中、未命中和輸出每百萬Token分別為0.02元、1元、4元,高峰時段翻倍;三檔價格全線下調,緩存命中降幅達60%。涉及deepseek-v4-flash及deepseek-v4-flash-vision-exp兩款模型。2026年9月9號 9:04316.
7kDeepSeek 一次性放出 150 個崗位:Harness 團隊急招工程師,規模膨脹倒逼後端重寫DeepSeek Harness團隊負責人崔添翼公開招人,一次放出約150個名額,稱新方向新系統需求多。這對以“小團隊、高人才密度”著稱的DeepSeek並非小招聘,是繼6月後再次擴招。本次更聚焦,僅招服務端開發與Agent彈性計算兩類,與此前“所有部門擴規模”的規劃不同。2026年9月8號 14:54263.2k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

無問芯穹與華環電子簽署戰略合作,共同探索國產異構算力AI基礎設施新方向
無問芯穹與華環電子簽署戰略合作協議,雙方將結合各自在AI軟體平台、網路通信與硬體研發的優勢,共同探索國產異構算力基礎設施的協同方案。此次合作聚焦於智算中心解決方案及「Token工廠」新模式,目標是推動計算、網路與AI原生基礎設施深度融合,為AI規模化應用提供高效穩定的支撐。
Jina AI Releases jina-ocr-v1: A 3.4B MoE Document Parser With Built-In Speculative Decoding for Low-Budget GPUs
Jina AI, part of Elastic, has released jina-ocr-v1, an end-to-end visual document parser. It takes PDFs, scans, tables, charts or invoices and returns clean Markdown in 1 pass. The model has 3.

優步全球範圍裁員 10%,被裁員工稱 AI 已大舉滲透日常工作
作者:清源 責編:清源 評論: 9 月 18 日消息,據《商業內幕》今天(18 日)晚間報道,在優步(Uber),AI 已經滲透到員工工作的許多環節,從回答 Slack 裡的內部問題,到替乘客行程中聯繫客服時收到的消息撰寫回復。6 名近期遭裁員的員工透露,過去幾個月,AI 在工作中的使用範圍明顯擴大,其中一些人甚至會通過提示詞讓 AI 完成相當一部分任務。

智譜 ZCode 被質疑“偷傳代碼”:官方回應稱問題已修復,將開源代碼庫、引入第三方審查
作者:清源 責編:清源 評論: 感謝網友 咩咩洋 的線索投遞!9 月 18 日消息,針對社區中有關代碼庫數據上傳的討論,智譜旗下編程產品 ZCode 今天(18 日)通過智譜官方群組向受影響用戶致歉,併發布回應稱已第一時間完成自查,相關問題目前已經修復。

月之暗面遞表之後,Kimi 的成色要被驗算三遍
舒澤品牌手記2026.09.18 18:16 · 來自浙江全文4982字00:00 / 14:05Anthropic 的 30 萬次指控,會成為招股書的第幾頁?文 | 舒澤品牌手記9月17日,月之暗面發佈了一套金融行業解決方案。按官方披露,中信建投、中金公司、易方達等數十家金融機構已經在用 Kimi 處理投研建模、風險排查和盡調材料——研究人員把管理層報表、審計報告和盡調文件交給 Kimi,拿回一份可以繼續調整假設的 Excel 模型。同一天,深圳商報記者就港股上市進展、股東架構調整等事項向月之暗面發去採訪函。

Calibre上手 AI 互動寫作:電子書管理器搖身變成"文字冒險遊戲引擎"
這個遊戲默認藏而不發,不會跟著 Calibre 啟動就冒出來。用戶得主動在"首選項 — 工具欄和菜單"裡把它請到主工具欄,才算真正激活。它的玩法很清晰:由 AI 在後臺搭起並掌管一個虛構世界,用戶通過不斷輸入文字來推著故事往前走,等於把"讀電子書"這件事,翻轉成了"和 AI 一起寫故事"。