調用量火爆致算力承壓,WorkBuddy 完成騰訊混元 Hy3 模型緊急擴容

2026年7月9日 01:317900 次瀏覽

重點摘要

AI資訊AI新閒資訊正文調用量火爆致算力承壓,WorkBuddy 完成騰訊混元 Hy3 模型緊急擴容發布於AI新閒資訊時間 :Jul 9, 2026閱讀 :1分鐘WorkBuddy 與騰訊混元聯合項目團隊發佈公告稱,因平臺首發搭載的混元 Hy3 大模型用戶調用需求遠超預期,算力資源出現高峰擁堵,項目組已火速完成算力擴容調度,保障服務穩定運行。

站內 AI 整理稿

AI 辦公智能體平台 WorkBuddy 於 7 月 9 日與騰訊混元聯合項目團隊共同發布公告指出,由於平台上首發搭載的混元 Hy3 大模型用戶調用需求遠超原先預期,導致算力資源在高峰時段出現擁堵狀況。經過緊急調度與擴容作業,目前算力已補足,服務恢復穩定運行。公告內容顯示,混元 Hy3 模型在 WorkBuddy 平台首發上線後,隨即吸引大量用戶湧入試用。自 7 月 8 日上午 10 點開始,平台算力資源消耗便觸及系統峰值,部分用戶開始遭遇排隊等待。到了當日下午,模型調用排隊比例一度突破 50%,顯示服務負載壓力急遽升高。

針對這一瞬間流量激增所引發的使用卡頓問題,WorkBuddy 與騰訊混元的項目團隊在第一時間啟動應變機制,迅速統籌調配可用的算力資源,並展開擴容補配工作。官方表示,目前所有擴容作業已全面完成,系統已可正常承接用戶對 Hy3 模型的調用需求,排隊現象也隨之緩解。與此同時,官方同步開放了用戶體驗反饋渠道,歡迎使用者持續試用,並針對模型表現或使用體驗提交優化建議,以便團隊進一步迭代產品。根據了解,騰訊混元 Hy3 模型於 7 月 6 日正式對外發布,並由辦公智能體工具 WorkBuddy 率先完成首發接入,開放給用戶免費試用。

為了吸引更多職場用戶體驗,WorkBuddy 同步推出了為期兩週的免費體驗活動。這款模型主打 Agent 智能體與生產力場景的能力升級,在多項辦公任務中展現出顯著效率提升。據官方公布的數據,Hy3 在文檔處理、PPT 生成、代碼編寫、流程自動化等應用上的任務完成成功率,已從前一代預覽版的 72% 提升至 90%;單一任務的平均耗時也縮減了 34%。這項實用屬性讓 Hy3 迅速獲得大批職場用戶與開發者的青睞,紛紛湧入平台進行體驗。值得注意的是,混元 Hy3 的預覽版本在先前測試階段就曾出現調用量爆發式增長。

根據相關統計,預覽版的 Token 總調用量達到上一代模型 Hy2 的 10 倍,而在 WorkBuddy 等智能體應用場景中,調用量漲幅更高達 16.5 倍。此次正式版上線後,市場熱度再創新高,進一步印證輕量化、高性能的國產大模型辦公工具正處於旺盛需求階段。業界分析指出,這波調用熱潮反映出企業與個人工作者對於以 AI 驅動的辦公自動化工具接受度持續提高,尤其是在文書處理、簡報製作與程式開發等日常環節,使用者期望能夠透過自然語言指令快速完成複雜任務。Hy3 的突出表現,正好填補了這塊市場缺口。

WorkBuddy 與混元團隊在公告中表示,非常感謝用戶的喜愛與包容,後續將持續優化算力調度機制與模型服務能力,並不斷迭代產品功能,致力為用戶提供更流暢、更穩定的 AI 辦公智能體服務。從整體態勢來看,WorkBuddy 自 2026 年初推出以來,已從騰訊 AI 戰略中的輔助角色逐步轉變為核心驅動力。其以極低的使用門檻——單句指令即可操作——成功切入非技術職場人群的痛點,在辦公場景中加速落地。此次與混元 Hy3 的深度整合,更讓平台在智能體應用的競爭格局中占據領先位置。

隨著大模型技術持續演進,以及更多企業與個人用戶逐步接受 AI 助手,類似於本次的調用高峰與算力壓力事件,未來可能成為業界常態。如何建立更具彈性與即時反應能力的算力調度體系,將成為各大平台必須面對的重要課題。但至少在此次事件中,WorkBuddy 與混元團隊以快速擴容的方式化解了危機,展現出技術團隊的應變能力與對用戶體驗的重視。

Related

相關文章

MarkTechPost AI生成式AI

使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線

在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。

52 分鐘前
MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

1 小時前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

3 小時前