雷峰網生成式AI

國內首個,千問辦公通過中國信通院辦公智能體能力評估

2026年8月6日 02:37

重點摘要

中國信通院公布辦公智能體能力評估結果,「千問辦公」成為國內首個通過評測的辦公Agent產品,在任務執行、數據安全與風險管理等關鍵能力上均達標。該評測涵蓋智能互動、多模態、任務執行、安全防護與Skills管理等四大維度共16項測試,千問辦公全數通過。此產品同時支援桌面端、雲端與企業協同Agent,並以端雲協同與縱深防禦機制強化企業級安全。

站內 AI 整理稿

中國信通院8月6日正式公布「互聯網智能體治理·辦公智能體能力評估」最新結果,「千問辦公」憑藉完整的功能體系與安全防護能力,成為國內首個通過該評估的辦公智能體(Agent)產品。這項結果意味著千問辦公在辦公任務執行、企業數據安全、風險管理等關鍵能力上均已達到國家級評估標準,具備可信賴、可落地的企業級辦公服務能力。隨著大型語言模型技術快速演進,Agent產品正加速走入各類辦公場景。與個人辦公場景不同,企業辦公環境涉及大量業務資料、客戶資訊與經營數據,Agent在自主執行任務的過程中,可能面臨提示詞濫用、資訊洩露、結果可信度不足等潛在風險。

這些風險不僅影響工作效率,更可能對企業資訊安全構成嚴重威脅,因此如何建立統一、可衡量、可驗證的能力標準,成為產業邁向規模化應用的關鍵課題。為此,中國信通院啟動首批互聯網智能體治理·辦公智能體能力評估工作,希望透過建立統一標準,引導業界在追求效能的同時兼顧安全,推動辦公智能體產品朝更成熟、更可信的方向發展。這項評估針對辦公場景的特殊性設計,覆蓋範圍從基礎能力到安全治理,試圖為企業採購與應用Agent產品提供明確參考依據。據了解,首批辦公Agent能力評估主要圍繞四大維度展開,包括智能交互與多模態能力、全場景辦公任務執行能力、安全防護以及Skills管理能力。

千問辦公在多模態處理、數據處理與分析、協同辦公適配能力、數據安全與私密性、服務環境安全、skill執行可信測試等16項測試中均達到評估標準,證明其足以滿足企業級場景對Agent功能豐富度和安全可控的雙重需求。在資訊安全方面,千問辦公基於端雲協同架構,建立了一套覆蓋基礎設施、應用、模型、Agent運行時、數據及擴展生態的縱深防禦體系。這套體系並非單點防護,而是在Agent執行任務的全流程中設置多重控制機制,包括沙箱執行、記憶安全等,確保每一個環節都具備對應的安全保障。針對提示詞注入和工具濫用等Agent特有風險,千問辦公提供了上下文隔離、運行監測、一鍵終止等能力。

換言之,當Agent在執行辦公任務過程中出現異常行為,管理人員可以即時介入並中斷操作,實現執行可管、風險可查、決策可溯,為企業打造可驗證、可審計的AI辦公安全底座。這種設計回應了企業客戶對黑箱操作的疑慮,也讓AI辦公工具在實際部署時更容易獲得信任。據介紹,千問辦公是業內首款同時支持桌面端Agent、雲端Agent、企業協同Agent的產品。三種形態的完整布局,使其得以覆蓋個人辦公、團隊協作與企業級部署等不同層級的使用情境,致力於幫助個人與企業全面提升辦公生產力。從產業角度來看,此次千問辦公率先通過中國信通院評估,不僅是對單一產品能力的肯定,更為辦公智能體市場樹立了可供對照的標竿。

在AI辦公應用日益普及的趨勢下,具備標準化評估機制的出現,將有助於篩選出真正兼具效率與安全的產品,也讓企業在選擇Agent服務時有了更清晰的判斷依據。未來,隨著評估體系的持續完善,辦公智能體有望在更廣泛的企業環境中落地,成為數位化轉型的重要推力。

Related

相關文章

MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

35 分鐘前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

2 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

3 小時前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

3 小時前