英偉達Vera CPU來了:專為AI代理從零設計,速度快1. 5 倍,OpenAI和Anthropic都要用
重點摘要
AI資訊AI新閒資訊正文英偉達Vera CPU來了:專為AI代理從零設計,速度快1. 5 倍,OpenAI和Anthropic都要用發布於AI新閒資訊時間 :Jul 8, 2026閱讀 :1分鐘AI搜索初創公司Perplexity宣佈計劃採用英偉達全新推出的CPU芯片Vera。這款芯片並非英偉達傳統GPU產品線的延伸,而是為迎接AI代理時代從零開始設計的全新架構產品,瞄準的正是傳統CPU在AI代理場景下"水土不服"的深層痛點。
英偉達(NVIDIA)正式推出全新架構的中央處理器Vera,這款晶片並非基於GPU路線延伸,而是為AI代理時代從零開始設計的CPU產品。AI搜尋新創公司Perplexity率先宣布將採用Vera晶片,並在實際測試中發現,其執行AI代理編碼任務的速度比傳統CPU快約1.8倍,訓練週期大幅縮短。這項突破性產品瞄準的正是現有英特爾與AMD處理器在AI代理場景下效能不足的核心痛點。Perplexity負責基礎設施的副總裁Nate Kupp透露,該公司在內部測試中已驗證Vera CPU的效能優勢。
他指出,AI代理作為能夠自主編寫程式碼、執行任務並協調複雜工作流程的程序,需要長時間不間斷運算,而傳統CPU在這種持續循環的負載下往往無法達到理想表現。Vera的出現正好填補了這個缺口。英特爾與AMD的CPU架構源自筆記型電腦時代,當初的設計目的是服務間歇性的人機互動——使用者打字、點擊、等待回應,然後再次操作。這種架構在應對AI代理不間斷的運算請求時,容易產生執行瓶頸。英偉達在官方部落格中進一步解析了傳統CPU的限制:較慢的執行速度會減少強化學習每個週期內的有效評估次數,進而拉長訓練時間,並增加單一用戶的服務延遲。
更嚴重的是,速度不足可能引發KV快取(Key-Value Cache)遺失,導致算力成本惡性循環,進一步影響整體效率。Vera的設計正是為了克服這些問題。英偉達團隊從基礎架構開始重新思考CPU該如何服務AI代理的工作負載,而非沿用過去數十年累積的通用處理器設計。這款晶片在指令集、快取層級、記憶體頻寬以及平行處理能力上都做了針對性最佳化,讓AI代理能夠在更短時間內完成更多迭代運算。Perplexity的測試結果印證了這項設計理念。該公司比較了Vera CPU與市面上主流傳統CPU在執行AI代理編碼任務時的表現,發現Vera的速度提升約1.8倍。
這不僅縮短了模型訓練的週期,也讓即時推理服務的反應更為敏捷。對於需要頻繁呼叫強化學習或大型語言模型的自動化系統而言,這樣的效能增幅意味著營運成本能顯著下降。Nate Kupp補充說,Perplexity的基礎設施團隊一直在尋找能夠匹配AI代理高強度運算需求的硬體方案。傳統CPU在面對大量序列決策與多工並發時,經常出現延遲抖動,影響使用者體驗。Vera在這些場景下展現出穩定且可預測的效能,讓他們決定率先導入。業界分析認為,英偉達切入CPU市場並非意外之舉。隨著AI代理從簡單的聊天機器人進化為能夠自主規劃、執行與修正任務的數位勞動力,現有伺服器架構的瓶頸越來越明顯。
GPU雖然擅長平行矩陣運算,但AI代理的運作仍需要CPU來處理控制流程、邏輯判斷與非結構化數據。如果CPU無法跟上GPU的速度,整個系統便會出現「等待」現象,抵消GPU的加速效果。Vera的推出代表英偉達對這個問題的直接回應。該公司將多年在GPU領域累積的平行計算經驗,轉化為全新CPU架構的設計思維,使得Vera在處理AI代理特有的循環邏輯時,能夠保持高吞吐與低延遲。同時,Vera也與英偉達自家的GPU生態系統深度整合,讓開發者可以在統一的軟體平台上調度兩種晶片,進一步減少數據傳輸的瓶頸。Perplexity並非唯一對Vera感興趣的AI公司。
業界傳出不少大型AI實驗室正在評估這款處理器,希望將其應用於下一代代理系統的訓練與部署。雖然英偉達尚未公布具體客戶名單,但從Vera的效能表現來看,它很可能成為AI基礎設施中不可或缺的一環。整體而言,Vera CPU的問世標誌著硬體產業進入一個新階段:處理器不再只是為了人類使用者的操作節奏而設計,而是為了永不停歇的AI代理而生。英偉達用這款從零打造的產品,向市場傳達了一個明確信號——未來的算力競爭,將圍繞AI代理的運算特質重新洗牌。
Related
相關文章

OpenAI首款AI硬件,為什麼是個沒有屏幕的「甜甜圈」
OpenAI與Jony Ive團隊合作的首款AI硬體,外型類似無螢幕的冰球大小圓環,被形容為金屬甜甜圈。這款設備定位為以AI為第一交互入口的計算設備,而非傳統智能音箱,售價可能落在300至400美元之間。
OpenAI 首款硬件真容浮現:冰球大小無屏設計,售價 300 至 400 美元
OpenAI首款硬件產品細節曝光,為一款無螢幕的智能音箱,外型類似冰球,售價約300至400美元,由OpenAI與前蘋果設計師Jony Ive的LoveFrom公司合作開發。該設備內建電池與攝影鏡頭,可支援手持使用並將視覺資訊傳給ChatGPT,實現多模態感知。此產品推出時正值蘋果對OpenAI提起商業機密訴訟,OpenAI內部評估其設計細節有望反駁侵權指控。

消息稱英偉達急尋中國 AI 基站供應商,與“下一個中際旭創”合作開發 6G 基站
NVIDIA正積極在中國尋找AI基站供應商,並有意與被視為「下一個中際旭創」的業者合作開發6G基站,顯示其從資料中心延伸至通訊基礎設施的布局。此舉凸顯NVIDIA對6G市場的重視,AI基站被視為整合邊緣運算與智慧調度的關鍵節點,但合作細節與技術方案尚未正式公布。
金剛GC3芯片重新定義視頻AI算力規則,國產RISC-V高端算力商業化提速
近日,第三屆中國計算機學會芯片大會(CCF Chip 2026)在太湖之濱無錫成功舉辦。會場中,兩院院士與頂尖工程師們的討論話題直指底層架構的“根技術”創新。一個核心追問被反覆推至臺前:當摩爾定律逼近物理極限,製程紅利日益稀薄,堆核心、拼頻率的老路越走越窄,是否該徹底換一條路走?換言之,與其在通用架構上不斷打補丁,能否從數據流動的本質出發,為特定場景原生設計一顆芯片?
把512 GiB閃存搬到xPU旁邊,HBF能打破推理內存牆?
HBM已經證明,通過堆疊和共封裝把存儲介質遷移至GPU附近,可以緩解AI計算中的數據搬運瓶頸。現在,SK海力士聯合閃迪,將類似的思路正式應用到NAND上,通過HBF將大容量閃存放到包括GPU在內的各類xPU旁,以緩解AI推理內存牆問題。近日,雙方通過OCP發佈《High Bandwidth Flash(HBF)High-Level Base Die Specification, Version 0.7.0》。

AI的錢,被誰賺走了?
AI 浪潮推動雲端服務供應商大舉擴建資料中心,背後龐大的資本支出正沿著供應鏈層層傳導,最終流向光模塊、晶片與伺服器業者。這條資金鏈路的起點是亞馬遜 AWS、微軟 Azure、Google Cloud 等雲端廠商,他們為了滿足訓練與推論大語言模型所需的算力,持續加碼採購 GPU 伺服器與高速網路設備,帶動上游零組件需求爆發。