OpenAI 首款自研芯片 Jalapeño 性能首秀:DeepSeek R1 每瓦 AI 吞吐量是 GB300 的 1.7 倍

作者:故淵 責編:故淵 評論: 感謝網友 愚公騎馬 的線索投遞!8 月 26 日消息,OpenAI 昨日(8 月 25 日)發佈博文,展示其首款自研 Jalapeño 芯片,並表示無論是單用戶 token 處理量,還是每千瓦吞吐量,都超過了目前市面上的頂尖推理處理器。在官方博文中,OpenAI 使用半導體研究公司 SemiAnalysis 開發的公共基準測試工具 InferenceX,通過 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 三款模型測試。
測試顯示對比市面上領先的 AI 系統(GB200 和 GB300),每瓦能夠完成的 AI 吞吐量是對比系統的 1.5 至 1.9 倍,端到端延遲則約為對比系統的 28% 至 59%。混合 Token 吞吐量與現有 AI 加速器的最快解碼速度對比3 款模型峰值單用戶解碼吞吐量各平臺最佳運行點的混合 Token 峰值吞吐量OpenAI 表示,Jalapeno 在運行 GPT-OSS 120B 時,每千瓦的峰值吞吐量比 GB200 系統高出約 1.9 倍。在 DeepSeek R1 上,它的每瓦性能比 GB300 高出約 1.7 倍;在 Kimi K2.
5 上,它的每瓦性能比 GB300 高出約 1.5 倍。Jalapeno 的額定功率為 700 瓦,但在測試工作負載期間,其持續功耗保持在 550 瓦或以下。附上相關圖片如下:延伸閱讀Jalapeño 是 OpenAI 首款自研 AI 推理芯片,由 OpenAI 與博通(Broadcom)合作開發,臺積電採用 3nm 製程代工製造,於 2026 年 6 月 24 日首次對外展示。該芯片是一顆 ASIC(專用集成電路),採用 systolic array(脈動陣列)架構,配備 HBM 高帶寬內存,專為大語言模型推理場景設計,不用於模型訓練。
芯片及配套服務器系統均不會對外銷售,僅供 OpenAI 內部使用,旨在降低自身 GPU 採購和算力運營成本。OpenAI 硬件負責人 Richard Ho 領導了該芯片的研發,他此前在 Google 工作近九年,是 Cloud TPU 項目的核心工程師。Jalapeño 從架構設計到完成流片僅耗時約 9 個月,OpenAI 稱這是高性能先進半導體領域有史以來最快的 ASIC 開發週期之一。OpenAI 自身的 AI 模型也深度參與了芯片設計流程,幫助加速設計優化。目前第二代 Jalapeño 芯片已進入後期開發階段,預計未來數月內完成流片;第三代芯片也已啟動概念設計。
OpenAI 計劃於 2026 年年底前小規模部署 Jalapeño,2027 年逐步擴大部署規模。需要注意的是,Jalapeño 此次測試對比的對象為英偉達 GB200 和 GB300 系統,尚未與英偉達最新一代 Vera Rubin 芯片進行對比測試。OpenAI 表示英偉達仍是其重要合作伙伴,未來將持續採用多供應商策略以滿足龐大的算力需求。
相關閱讀:《OpenAI 秀肌肉,與博通共研的 Jalapeño 芯片將向英偉達 GB300 發起挑戰》 投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:OpenAI,Jalapeño 芯片AI 競賽升溫:曝 OpenAI 已預訓練 Bel 模型:超 10T 參數,衝擊通用人工智能OpenAI 發佈適用於 ChatGPT Work 和 Codex 的 Admin 插件,管理員可通過對話管理用戶和權限OpenAI 奧爾特曼承認自己高估 AI 普及速度:最大阻力其實是改變用戶習慣OpenAI 秀肌肉,與博通共研的 Jalapeño 芯片將向英偉達 GB300 發起挑戰美國阿拉巴馬州向 OpenAI 發出傳票,就其模型入侵 Hugging Face 事件展開調查Anthropic 最強大模型 Fable 5 遇冷,企業用戶轉向更便宜 AI 產品
Related
相關文章

雄安“一人公司”湧動:被大廠裁員的P7,用AI組裝自己的“資本夢”
大模型之家2026.08.26 09:19 · 來自北京全文3010字00:00 / 08:16“當一個人就是一家公司,技術槓桿是蜜糖,也是砒霜。”文 | 大模型支架“當一個人就是一家公司,技術槓桿是蜜糖,也是砒霜。”在雄安新區幾處安靜的科技孵化器裡,一種全新的辦公形態正在悄然蔓延。這裡的辦公桌上沒有成排的顯示器和忙碌的團隊,往往只有一臺筆記本電腦、幾杯咖啡,以及一位眼神專注的創業者。他們中的相當一部分人,是過去兩年從北京後廠村或杭州離職後,出來創業的互聯網大廠中高層——曾經的P7、P8級架構師、高級產品經理。

Edge AI Daily 早報(8月26日)
Edge AI Daily2026.08.26 08:37 · 來自北京全文7099字00:00 / 19:12德意志銀行核心系統遷移至谷歌雲,標誌金融AI落地的結構性變革;OpenAI以Codex經驗進軍白領市場,推出ChatGPT Work及貼紙功能,意圖成為社交操作系統;湯森路透以4000萬美元訓練垂直模型,證明數據質量可替代算力規模;ARIA全球首禁純AI歌曲,監管紅燈亮起;WikiHow起訴OpenAI,版權衝突升級。

谷歌殺入法律 AI 賽道,推出專用 Gemini 工具
作者:遠洋 責編:遠洋 評論: 8 月 26 日消息,Alphabet 旗下谷歌週二擴展了其 Gemini Enterprise 人工智能平臺,推出面向律師和律所的新工具,進一步加劇了科技公司爭奪法律行業 AI 需求的競爭。谷歌表示,Gemini Enterprise for Legal 將幫助律所利用 AI 處理日常工作以及複雜任務,讓律師能夠將更多精力投入到價值更高的專業服務,同時確保數據的安全性和保密性。
谷歌殺入法律 AI:Gemini Enterprise 推出專用法律工具,劍指律所賽道
該工具提供與法律軟件、數據平臺集成的插件及一系列 AI 智能體,可處理專業化法律與行政工作而無需大量人工監督,讓律師聚焦更高價值服務,同時強調數據安全與保密。行業定製戰全面鋪開除法律外,谷歌同日推出金融服務行業工具,並計劃陸續覆蓋更多垂直領域。
馬雲及管理層連日增持超8億港元 阿里巴巴800億配售資金全數加碼AI
結合此前披露的蔡崇信與吳泳銘連續兩日合計增持的2億港元,阿里巴巴創始人及高管團隊近期已累計增持超8億港元。在此前的8月23日,阿里巴巴正式宣佈發起800億港元的新股配售方案,所得資金將全部注入AI建設與相關技術佈局。此次配售獲得了全球主權財富基金等長線投資機構的熱烈追捧,最終實現近3倍的超額認購,顯示出資本市場對阿里AI轉型方向的積極態度。
Anthropic打通Claude與Cowork記憶系統 消除跨工作流重複交互痛點
此次更新的核心在於解決了 AI 助手在複雜工作流中信息斷層的痛點。此前,用戶在與 Claude 聊天階段形成的項目想法或細節,在轉入 Cowork 執行階段時往往需要重新輸入。系統升級後,Claude 在聊天過程中即可將關鍵話題實時錄入記憶庫,無需等待對話結束彙總。