AI 推理 MLPerf 6.1 發佈:AMD 以 512 個 MI355X 刷新紀錄、英偉達 Vera Rubin 首次現身

作者:故淵 責編:故淵 評論: 9 月 17 日消息,科技媒體 Wccftech 昨日(9 月 16 日)發佈博文,報道稱在 MLPerf Inference v6.1 發佈後,AMD、NVIDIA 等廠商同步提交結果。注:MLPerf Inference 是由 MLCommons 維護的推理基準測試套件,用於衡量不同硬件在 AI 推理任務中的吞吐和延遲表現。最新 6.1 版重點集中在 AI 推理吞吐、擴展效率和不同 GPU 配置下的表現。
AMD 稱以 575 萬個 token / 秒的速度在 512 個 GPU 規模下創造了新的 MLPerf 記錄,這是 AMD 迄今為止規模最大的提交,再次證明了 AMD 的性能、規模、軟件成熟度和可復現性。DeepSeek R1 測試中,AMD 以 512 個 Instinct MI355X GPU 參賽,離線(強調批量處理能力,通常用於衡量系統在非實時場景下的最大吞吐)成績 2,901,950 tokens/s,服務器(強調在線服務場景中的吞吐與響應能力,更接近實際部署中的請求處理環境)成績 2,405,310 tokens/s。
英偉達在同一項目中提交 GB300 和 GB200 的 288 GPU 配置,GB300 離線 2,705,130 tokens/s,服務器 2,028,030 tokens/s。由於配置存在差異,以上數據僅供參考。此外英偉達的 Vera Rubin VR200 首次進入 MLPerf 推理基準,共出現了 36 GPU 和 72 GPU 兩種配置。在相同 72 個 GPU 配置下,Vera Rubin (VR200) 要比 GB300 快 95%,此外 36 GPU 配置版本要比 72-GPU GB200 配置更快。投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮
Related
相關文章

美國 AI 巨頭提議開發減速,歐洲同行和政界並不認同
作者:清源 責編:清源 評論: 9 月 18 日消息,據路透社今天(18 日)報道,此前,阿莫迪、奧爾特曼和馬斯克先後發出警告,能力不斷增強的 AI 系統可能帶來風險,故有必要控制其發展節奏,但歐洲企業和官員對此表現出明顯懷疑。法國初創企業 Mistral 在聲明中指出,這些風險早在幾個月前就已十分明確了。

MiniMax Code CLI 正式開源,在評測中取得 76.7% 的任務通過率
作者:沁滄(實習) 責編:沁滄 評論: 感謝網友 Domado 的線索投遞!9 月 18 日消息,MiniMax 今晚宣佈,MiniMax Code CLI 的 v0.4.12 版本面向全球開發者正式開放,並且以 MIT 協議正式開放源代碼。

北京發佈“詞元經濟十條”:高標準建設詞元工廠,推動關鍵核心技術攻關
作者:浩渺 責編:浩渺 評論: 感謝網友 蛋殼兒 的線索投遞!9 月 18 日消息,北京市經濟和信息化局今日宣佈,北京市“詞元經濟十條”正式發佈。為貫徹落實《國務院關於深入實施“人工智能+”行動的意見》(國發〔2025〕11 號),率先培育智能經濟新形態,以詞元(Token)為抓手,發展詞元經濟新增量,制定《北京市加快詞元經濟發展的行動方案(2026—2028 年)》(注:以下簡稱《行動方案》)。
PrismML Releases Ternary Bonsai 2 27B: A 5.9 GB Apache 2.0 Model Retaining 98.2% of Qwen3.8 27B Performance
PrismML has released Ternary Bonsai 2 27B, a ternary-weight version of Qwen3.8 27B. The language model occupies 5.93 GB, against 53.80 GB in FP16. PrismML reports that it keeps 98.2% of the parent model’s average across 20 benchmarks.

OpenAI剛曝光循環架構,這家公司更早將其用於世界模型
鍵詞只有一個:循環。 Astra採用了一種被稱為“循環深度”(Recurrent Depth)的架構,本質是讓同一組Transformer層被反覆複用,用更少的參數實現更深的計算。 這被外界視為OpenAI對傳統“堆參數、堆算力”路線的一次重大修正——不再只是把模型做大,而是讓模型學會“反覆思考”。 消息一齣,整個AI社區迅速升溫。

千問辦公接入高德門店經營專家套件 提升實體店選址與經營效率
此項新功能自9月18日起正式上線,用戶只需在千問辦公添加相應套件並完成高德賬號授權,即可實現從門店選址到日常經營分析的全鏈路工作。隨著實體商業的不斷發展,傳統的人工選址和經營分析方式顯得效率低下且容易出錯。個體創業者在開新店時,往往需要花費大量時間進行實地勘察,整體耗時可達一週,而商家在監測門店熱度變化及競爭對手動態時,也面臨數據整理繁瑣、分析結果不準確的問題。