IT之家生成式AI

DeepSeek R1 推理測試:英特爾 Arc Pro B70 顯卡吞吐最高 2320.76 token/s

2026年7月9日 11:19
DeepSeek R1 推理測試:英特爾 Arc Pro B70 顯卡吞吐最高 2320.76 token/s

重點摘要

藍戟測試英特爾Arc Pro B70 GPU在DeepSeek R1模型推理表現,高併發時吞吐量超越RTX 5090D與RTX 4090D,最高可達每秒2320.76個token。在併發128與256時,Arc Pro B70分別比RTX 5090D高出8.6%與7.5%,展現優異的AI推理效能。

站內 AI 整理稿

根據科技媒體 Wccftech 於 7 月 8 日發表的測試報告,顯卡廠商藍戟(GUNNIR)針對英特爾 Arc Pro B70 GPU 在 DeepSeek R1 模型上的推理表現進行了實測,結果顯示這款採用 Intel 架構的專業繪圖卡在多項高併發情境下,token 吞吐量不僅超越同級產品,甚至勝過目前市場上最頂級的 Nvidia GeForce RTX 5090D 與 RTX 4090D 顯卡,成為 AI 推理效能的一匹黑馬。

本次測試統一採用四張顯卡組成的多卡配置,實驗對象包括英特爾 Arc Pro B70 32GB、Nvidia RTX 5090D 32GB 以及 Nvidia RTX 4090D 24GB 三款顯卡。測試模型選定為 DeepSeek R1-Distill Qwen 32B FP16,並將輸入與輸出的 token 長度固定為 128 個 tokens,以確保變數一致。測試範圍涵蓋從 1 到 512 的完整併發(concurrency)區間,最終以每秒 token 數(token/s)作為衡量大語言模型推理輸出效率的核心指標。

在低併發場景,即併發數低於 32 時,Nvidia RTX 5090D 的表現仍居首位,RTX 4090D 緊隨其後,而英特爾 Arc Pro B70 的效能則與 RTX 4090D 大致持平,展現出與高階消費級顯卡競爭的實力。隨著併發數提升至 32 與 64,Arc Pro B70 開始追平並逐步超越 RTX 4090D,成長曲線相當明顯。當併發數達到 128 時,英特爾 Arc Pro B70 的 token 吞吐量已經比 RTX 5090D 高出 8.6%,同時比 RTX 4090D 高出 34.2%。

這個差距在併發數進一步拉高至 256 時更為明顯,Arc Pro B70 的吞吐量領先 RTX 5090D 約 7.5%,並領先 RTX 4090D 高達 48.7%。在最高併發 512 的測試情境下,也觀察到相近的效能優勢,證實該 GPU 在高併發環境下具備優異的擴展性。整體來看,英特爾 Arc Pro B70 GPU 在本次測試中創下了最高每秒 2320.76 個 token 的吞吐量紀錄,在所有測試顯卡中名列前茅。這項數據不僅展現了英特爾 Arc Pro 系列專業顯卡在 AI 推理工作負載上的潛力,也反映出大容量記憶體與架構設計在高併發場景下的重要性。

值得注意的是,測試中使用的 RTX 5090D 與 RTX 4090D 均為 Nvidia 針對中國市場推出的特定版本,分別具備 32GB 與 24GB 的 GDDR6X 記憶體。而英特爾 Arc Pro B70 同樣搭載 32GB 記憶體,與 RTX 5090D 的記憶體容量相同,但其記憶體頻寬與架構設計卻能在高併發推理任務中取得明顯優勢,顯示出 Intel 在 AI 推論加速領域的競爭力正在快速提升。藍戟作為英特爾 Arc 系列顯卡的合作夥伴,長期專注於專業繪圖與 AI 運算領域的產品開發。

此次測試結果不僅驗證了藍戟在硬體整合與驅動優化上的實力,也為企業用戶在選擇 AI 推論硬體時提供了新的參考選項。相較於價格高昂的 Nvidia 高階顯卡,英特爾 Arc Pro B70 在特定工作負載下能以更低的成本提供相當甚至更佳的效能,性價比優勢相當突出。此外,測試過程中使用的模型 DeepSeek R1-Distill Qwen 32B FP16 屬於輕量化的開源大語言模型,適合在單卡或多卡環境下進行高效推理。這類模型在企業級應用中越來越常見,尤其是在需要同時處理大量用戶請求的場景,例如客服機器人、內容生成與即時分析等,高併發吞吐量便成為關鍵效能指標。

Wccftech 的報導指出,英特爾 Arc Pro B70 在 DeepSeek R1 模型上的表現,不僅證明了 Intel 在 AI 推理領域的技術實力,也為市場帶來更多元的硬體選擇。隨著 AI 模型持續演進,推理階段的效率將直接影響企業的營運成本與服務品質,這類測試數據對於採購決策具有重要參考價值。整體而言,本次測試結果顯示,在特定高併發推理情境下,英特爾 Arc Pro B70 已具備與 Nvidia 頂級消費級顯卡一較高下的實力,甚至在某些指標上取得領先。

這不僅是英特爾 Arc 系列產品的一個重要里程碑,也預示著 AI 推理硬體市場將不再由 Nvidia 一枝獨秀,更多元的競爭格局正逐步成形。

Related

相關文章

MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

33 分鐘前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

2 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

3 小時前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

3 小時前