DeepSeek 論文上新:130 餘人署名、梁文鋒列末位,公開智能體訓練沙箱 DSec

AI資訊AI新聞資訊正文DeepSeek 論文上新:130 餘人署名、梁文鋒列末位,公開智能體訓練沙箱 DSec發佈於AI新聞資訊發佈時間 :2026年9月24號 11:25閱讀 :1分鐘DeepSeek 日前發佈一篇系統論文,首次公開了旗下大規模智能體訓練專用沙箱基礎設施的核心技術細節。該論文題為《DeepSeek 彈性計算(DSec):面向大規模智能體訓練的高效沙箱基礎設施》,全文長達 31 頁,提交時間為 9 月 19 日。值得一提的是,論文作者團隊規模超過 130 人,DeepSeek 創始人梁文鋒位列作者名單最後一位。
自研沙箱平臺 DSec,單單元日均服務 300 萬實例據論文介紹,DSec(DeepSeek Elastic Compute)是 DeepSeek 自研的生產級彈性計算沙箱平臺,為其內部專屬基礎設施,核心用途是為大模型智能體(Agent)的大規模訓練與評測任務提供安全穩定的沙箱運行環境,保障海量 Agent 訓練任務高效、穩定落地。論文披露的生產環境數據顯示,DSec 具備極強的大規模併發處理能力:一個標準 DSec 生產單元由 160 臺 CPU 節點組成,共計 3 萬個 CPU 核心、約 250TB 內存,可管理 PB 級別的鏡像文件與環境層級資源。
在日常生產場景中,該單元每日可服務約 300 萬個沙箱實例,穩定支撐超 38 萬個併發沙箱同時運行,沙箱創建速率峰值可達每秒 5000 次以上。降低資源開銷,提升內存效率經過實際部署與模型評測經驗驗證,DSec 的多項核心機制降低了訓練環境搭建、鏡像分發的資源開銷,並大幅提升了整體內存利用效率。此次論文將這一基礎設施對外公開,也讓外界得以一窺支撐 DeepSeek 海量智能體訓練背後的底層工程能力。相關推薦DeepSeek 傳將向聯合國安理會閉門通報 AI 潛在風險與安全挑戰人工智能競爭正上升為全球安全與地緣政治議題。
據報道,中國AI初創企業DeepSeek預計本週將向聯合國安理會就人工智能潛在風險與安全挑戰作專題通報,此舉凸顯國際社會對中國大模型企業在技術治理與風險防範方面的高度關注。2026年9月23號 9:52158.3k消息稱高瓴創投合夥人嚴文韜加入DeepSeek,擔任CFO高瓴創投合夥人嚴文韜9月21日加入DeepSeek任CFO,補齊公司成立三年來空缺的首席財務官職位,顯示治理與財務管理體系進一步完善。嚴文韜1991年生,復旦畢業,曾任職騰訊投資、H Capital及高瓴創投。此前兩個月,多位頭部VC年輕合夥人參與該崗位競聘。2026年9月22號 14:07190.
2kDeepSeek明確調休日計費規則,中秋國慶迎來十天"半價窗口"DeepSeek發佈API峰谷計費補充說明:調休上班的週末及中國法定節假日全天均按空閒時段低谷價計費。這意味著9月20日、10月10日調休週末及中秋國慶假期,開發者調用API可享低谷價。此前工作日高峰時段價格為低谷兩倍,週末全天按低谷價。2026年9月20號 13:55245.4k爆料稱 DeepSeek 下一波大模型將至:3 萬億參數,性能劍指 GPT-6 AstraDeepSeek本週發佈V4.1 Flash,架構變化巨大但未升大版本號。V4.
1 Pro已確定,具體升級未公佈,性能上限或較高,但鑑於前代Pro不及預期,外界期待不宜過高。另有Code 2.0被曝即將發佈,主打電腦控制,後續還有更多大模型。2026年9月14號 14:16409.4k衝擊科創板!DeepSeek 傳已聘請中信證券籌備年內 IPO,估值劍指 5000 億DeepSeek已聘請中信證券籌備科創板上市,計劃年內遞交IPO申請、明年掛牌。募資將主要用於擴大算力基礎設施、加大前沿大模型與芯片自研投入,並強化核心研發人才激勵。2026年9月9號 15:38252.9k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

MiMo-V2.6剛發,小米羅福莉扔出MiMo-V3新架構!引用DeepSeek多項成果
(公眾號:zhidxcom) 作者 | 江宇 編輯 | 李水青 9月24日報道,昨晚,小米MiMo大模型負責人羅福莉發文,提前披露了MiMo-V3的新架構,其核心組件HySparse2率先登場,相關技術論文同步公佈。▲羅福莉發文 簡單來說,這套新架構主要解決Agent越做越多輪之後出現的三個問題:長輸入算得太多、緩存佔得太大,以及如何從越來越長的上下文裡準確找到需要的信息。

OpenAI、Anthropic同日模型大戰,“是兄弟就砍一刀”
光錐智能2026.09.24 16:43 · 來自廣西全文3968字00:00 / 10:28刀刀見骨,AI巨頭為自己畫過的大餅“填窟窿”文|光錐智能,作者 | 魏琳華 ,編輯|劉俊宏9月23日凌晨,OpenAI和Anthropic像約好了一樣,前後腳各自放出新模型:OpenAI端出了GPT-6 Sol和GPT-6 Luna兩款模型,把旗艦GPT-6 Astra的能力蒸進更快更便宜的型號裡;Anthropic則亮出Claude Opus 5.5,性能追平Fable 5.1的同時,成本只有上代Opus 5的六成。

騰訊混元推出"騰訊 Hy 翻譯"App:支持 33 種語言互譯,覆蓋 5 種民族語言
該產品基於騰訊混元 Hy-MT2 翻譯模型打造,支持 33 種語言互譯,並覆蓋 5 種中國少數民族語言及方言,提供語音翻譯、拍照翻譯與離線翻譯等多種方式。離線可用、覆蓋港澳臺及東南亞據介紹,離線翻譯模式下用戶可提前將翻譯模型下載至手機,在沒有網絡或信號不佳時仍能穩定使用。

谷歌確認新一代旗艦 Gemini 4 即將推出:已進入後訓練,有望遠早於年底
所謂後訓練,是在基礎模型完成後進一步調整、提升行為可靠性的階段。跳過 3.5 Pro,直接押注 Gemini 4卡武克奧盧希望 Gemini 4 在"遠早於年底"的時間點推出,並稱正儘快拿出後訓練階段的早期成果,"因為我們看到了結果,也很振奮",隨後谷歌會繼續快速迭代。

消息稱DeepSeek年化收入突破10億美元,擬募資500億元衝刺上交所上市
該業績躍升主要得益於近期產品定價的上調,以及其系列模型在開發者與企業端持續攀升的採用率。DeepSeek首席執行官梁文峰在近期舉辦的投資者會議上披露了這一核心財務數據。此舉被視為在資本市場關鍵節點提振投資人信心的重要舉措——目前DeepSeek正接近完成第二輪融資,並緊鑼密鼓地籌備在上海證券交易所上市。
