英偉達展示 DSX MaxLPS 技術,AI 工廠每兆瓦 token 吞吐量最高提升 40%

作者:故淵 責編:故淵 評論: 9 月 17 日消息,科技媒體 Wccftech 昨日(9 月 16 日)發佈博文,報道稱在 AI 基礎設施峰會上,英偉達展示了面向 AI 工廠的 DSX MaxLPS 功耗調度系統,每兆瓦 token 吞吐量最高提升 40%。注:每兆瓦 token 吞吐量是指數據中心每消耗 1 MW 電力時,AI 系統每秒能夠生成或處理多少個 token。該指標把功耗納入計算,因此更適合衡量 AI 數據中心在電力受限條件下的產出能力。英偉達 DSX MaxLPS 技術已由 Emerald AI 集成至 Conductor 平臺,用於電網條件下的數據中心負載編排。
Conductor AI 平臺中的 DSX Flex 可依據電網狀態動態調整數據中心用電需求。平臺已接收 200 次電網狀態信號,相關操作均未要求用戶干預。Lambda 等雲服務商測試後,在固定功率預算下取得 24% 的 token 吞吐量提升。Lambda 是一家 GPU 雲服務商,客戶數量超過 10,000 家。測試集群包含 5 個機架和 19 個節點。在與 16 個節點滿功率運行相同的功率預算下,19 個節點的集群吞吐量從約每秒 400 萬個 token 提升至每秒 500 萬個,增幅為 24%,每瓦性能提升 23%。
NVIDIA 還披露,Vera Rubin 和 Groq 3 LPX 機架在相同站點功耗範圍內,GPU 數量最多可增加 40%。在不新增電力線路的條件下,token 吞吐量最多可提升 35%。在 100K 上下文、Qwen 3.8 27B 工作負載中,Groq 3 LPX 達到每位用戶每秒 2,529 個輸出 token。多家人工智能企業已參與早期測試 Vera CPU,相關結果顯示性能最高提升 1.9 倍、吞吐量提升 73%、查詢任務吞吐量提升 3.3 倍。Perplexity 測得 SPACE 安全沙箱啟動速度提升 1.9 倍,DeepInfra 測得編排步驟延遲速度提升 2.2 倍。
Redpanda 的測試顯示,Vera CPU 相比其他 CPU 延遲降低 5.5 倍,吞吐量提升 73%。Starburst 測得查詢吞吐量提升 3 倍,Kinetica 測得分析查詢性能提升 2.7 倍。
投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:英偉達,AI2026 最大規模 AI 供應鏈洩露:40 分鐘搜刮英偉達等全球約 2500 家共 195TB 數據性能優勢高於預期:AMD 稱 Venice 處理器比英偉達 Vera 快約 20%英偉達加速 AI 算力供應:Grace 芯片累計交付超 250 萬顆,Vera Rubin 機架目標日產 1000 臺DeepSeek-v3 671B 測試:英偉達 Blackwell GB300 刷新 MoE 預訓練世界紀錄,每 GPU 算力 1648 TFLOPs智能體 AI 測試:英偉達 Vera CPU 比英特爾 Sapphire Rapids 快 2.
2 倍英偉達詳解 Vera CPU:專為智能體 AI 構建,88 個 Olympus 核心、1.2 TB/s LPDDR5X 內存
Related
相關文章

美國 AI 巨頭提議開發減速,歐洲同行和政界並不認同
作者:清源 責編:清源 評論: 9 月 18 日消息,據路透社今天(18 日)報道,此前,阿莫迪、奧爾特曼和馬斯克先後發出警告,能力不斷增強的 AI 系統可能帶來風險,故有必要控制其發展節奏,但歐洲企業和官員對此表現出明顯懷疑。法國初創企業 Mistral 在聲明中指出,這些風險早在幾個月前就已十分明確了。

MiniMax Code CLI 正式開源,在評測中取得 76.7% 的任務通過率
作者:沁滄(實習) 責編:沁滄 評論: 感謝網友 Domado 的線索投遞!9 月 18 日消息,MiniMax 今晚宣佈,MiniMax Code CLI 的 v0.4.12 版本面向全球開發者正式開放,並且以 MIT 協議正式開放源代碼。

北京發佈“詞元經濟十條”:高標準建設詞元工廠,推動關鍵核心技術攻關
作者:浩渺 責編:浩渺 評論: 感謝網友 蛋殼兒 的線索投遞!9 月 18 日消息,北京市經濟和信息化局今日宣佈,北京市“詞元經濟十條”正式發佈。為貫徹落實《國務院關於深入實施“人工智能+”行動的意見》(國發〔2025〕11 號),率先培育智能經濟新形態,以詞元(Token)為抓手,發展詞元經濟新增量,制定《北京市加快詞元經濟發展的行動方案(2026—2028 年)》(注:以下簡稱《行動方案》)。
PrismML Releases Ternary Bonsai 2 27B: A 5.9 GB Apache 2.0 Model Retaining 98.2% of Qwen3.8 27B Performance
PrismML has released Ternary Bonsai 2 27B, a ternary-weight version of Qwen3.8 27B. The language model occupies 5.93 GB, against 53.80 GB in FP16. PrismML reports that it keeps 98.2% of the parent model’s average across 20 benchmarks.

OpenAI剛曝光循環架構,這家公司更早將其用於世界模型
鍵詞只有一個:循環。 Astra採用了一種被稱為“循環深度”(Recurrent Depth)的架構,本質是讓同一組Transformer層被反覆複用,用更少的參數實現更深的計算。 這被外界視為OpenAI對傳統“堆參數、堆算力”路線的一次重大修正——不再只是把模型做大,而是讓模型學會“反覆思考”。 消息一齣,整個AI社區迅速升溫。

千問辦公接入高德門店經營專家套件 提升實體店選址與經營效率
此項新功能自9月18日起正式上線,用戶只需在千問辦公添加相應套件並完成高德賬號授權,即可實現從門店選址到日常經營分析的全鏈路工作。隨著實體商業的不斷發展,傳統的人工選址和經營分析方式顯得效率低下且容易出錯。個體創業者在開新店時,往往需要花費大量時間進行實地勘察,整體耗時可達一週,而商家在監測門店熱度變化及競爭對手動態時,也面臨數據整理繁瑣、分析結果不準確的問題。