阿里千問AI平臺全面升級模型服務、Agent服務、AI應用

上,阿里巴巴集團戰略副總裁、ATH事業群MaaS業務線總裁文徵宣佈千問AI平臺全面升級:以推動Agent進入生產作為建設核心,在模型服務基礎上新增對Agent服務、行業AI解決方案的支持,並推出了API優速模式、Agent Studio、千問AI座艙解決方案等一系列能力,幫助企業將智能轉化為生產力。從消耗Token到交付結果,AI價值的衡量方式正在改變 文徵表示,AI仍處於非常早期的階段,用戶覆蓋、場景滲透和算力規模均有巨大增長空間。持續增長的Token用量說明,AI需求已不再是一道需要證明的題,關鍵在於誰能將智能轉化為結果。
單任務價值、Token生產效率和單Token能力,共同決定“智能價值密度”。過去一年,阿里雲MaaS平臺服務的客戶數增長六倍。隨著訂單、代碼、內容和業務流程主動發起調用,Agent開始進入企業核心流程,企業需要的不再只是一個模型API,而是一套覆蓋模型供給、生產運行、Agent構建與託管的完整體系。智能正在從被調用走向被交付。需求的持續放大,對算力和基礎設施提出了更高要求。阿里將堅定投入全棧AI,預計到2032年,阿里雲運營的算力規模將超過20GW,支撐從芯片、AI基礎設施,到千問大模型、模型服務、Agent工具和AI原生應用的完整AI體系,加速Agent時代的產業進化。
面向Agent負載持續完善模型服務 在模型供給方面,千問AI平臺以“First and Best”原則,支持全球一流的自研和開放模型第一時間上線。針對Agent決策鏈路長、併發高、對時延敏感等特點,平臺通過FlashBoot、UniScheduler等能力調度異構算力,將模型彈性啟動時間由1200秒縮短至70秒,可在1分鐘內拉起1萬個Pods;首Token延遲降低38%,Prompt Caching成本最高節省95%。平臺提供99.9%生產級SLA、十億級單客戶峰值TPM和CMaaS機密推理服務,支持監控、告警和成本治理。本次升級的API優速模式可將TPS提升1.
5至2倍,用戶切換model ID即可使用;吞吐預留(PTU)新增夜間8小時預留規格;獨佔吞吐(DTU)則面向大型企業及金融、政企客戶,支持定製模型部署與性能定製。在服務模式上,Token Plan以一份訂閱覆蓋Qwen、Kimi、GLM、DeepSeek等多類模型,原生打通Qoder、Cursor、Codex、OpenClaw等主流編程工具與Agent框架,並可與千問App、千問辦公共享抵扣。結合按量付費、優速模式、吞吐預留與獨佔吞吐,從個人到企業的各類需求均可在同一平臺獲得對應供給。
Agent Studio發佈,提供企業級全棧Agent服務 從模型調用到業務結果,Agen需要模型匹配、任務運行、上下文接入和服務調用等基礎能力。千問AI平臺正式發佈企業級全棧Agent服務平臺Agent Studio,可根據任務自動路由選擇模型,提供24小時不間斷託管運行,並支持企業內部知識數據和外部軟件服務接入。在Agent開發運行方面,平臺提供原子API,50多個原子API覆蓋運行環境、長期記憶、工具服務、會話請求和服務端點部署等能力,企業可按需組合並接入自身業務;全新的Agent API即將發佈,可將環境、記憶、工具、部署等需逐項調用的配置,一次請求全部搞定。
Agent Studio還將推出Agent自進化引擎,包含運行觀測、AI評測器、AI優化器和自動驗證等能力,支持在上下文交互中持續調優與進化。同時,針對Agent生態服務,One Key MCP可用一個API Key連接100多項生態服務,包括高德、飛豬、1688及金融、法律等各領域服務。平臺還可自動理解需求、尋找工具並完成調用,減少開發者逐一註冊和配置鑑權的工作, 以全棧基礎能力,支撐應用與行業落地 在應用和行業側,千問AI平臺通過自身產品實踐持續驗證技術和體驗,並將沉澱能力向生態開放。Meoo 1.0通過CLI和OpenAPI提供應用構建、部署及企業協作能力;伶鵲2.
0服務20個行業、5000餘家企業客戶和超過10萬個坐席;萬鏡一刻以Agent、創作工作臺和技能廣場服務視頻生產,萬小智3.0則從建站延展至獲客和經營,推動“Vibe Coding”走向“Vibe Business”。在行業與終端場景,泛海集團基於千問搭建工業AI平臺和數控工藝Agent,沉澱工程師經驗與零件案例;網易遊戲與千問AI平臺圍繞遊戲研發鏈路開展合作。
榮耀基於Qwen Intelligence方案,以端雲協同的方式,為榮耀YOYO智能體提供多模態理解、長鏈路任務規劃等能力,推動AI手機從被動響應走向主動服務;比亞迪依託千問AI座艙解決方案打造座艙超級智能體,支持理解和執行模糊、多重指令。文徵認為,平臺的價值不是定義所有應用,而是讓更多應用生長出來。只有將模型服務、Agent服務、AI原生應用和行業實踐連成體系,智能才能從通用能力走向產業生產力。目前,相關模型服務和Agent能力已在千問AI平臺上線。開發者可通過API完成產品集成或訂閱Token Plan,在已支持的常用AI工具中直接調用相應模型和服務。
版權所有,未經授權不得以任何形式轉載及使用,違者必究。
Related
相關文章

Jev vs Decitron:同為決策AI,為什麼不是一回事?
它來自TypeSafe AI。這支有OpenAI背景的團隊沒有繼續卷生成和推理,而是換了個方向:讓AI直接做判斷。他們甚至把口號直接寫成:Decisions, not strings(要決策,不要文本)。Jev的走紅,也讓“Decision”(決策)重新成為AI圈的熱門詞。

高通發佈驍龍 8 Elite Gen 6 與 Extreme 芯片,支持本地運行 300 億參數大模型
這兩款新芯片將 AI 賦能作為核心發力點,旨在為移動終端提供更強大的端側智能算力,進一步推動 AI 代理(AI Agents)在手機端的深度個性化應用。在核心架構與本地大模型支持方面,這兩款芯片配備了全新的傳感中樞(sensing hub),能夠支持運行高達2.

實時世界模型進入“全科生”階段,PixVerse R2先交卷!
愛詩科技推出全新實時世界模型PixVerse R2,號稱解決了實時生成與通用能力難以兼顧的業界難題。R2基於統一可擴展框架,整合文字、圖像、聲音與動作,實現場景持續演化與音畫同步控制,上線後即登上X平台熱度榜。

Win11 驚現 AI 惡意軟件 ClosedQuorum:入侵後自主決策,專挖最有價值信息
該惡意軟件主要針對 Windows 11 平臺,會在成功入侵用戶電腦後調用谷歌 Gemini、DeepSeek、Qwen 和 Mistral 等 AI 模型自主決策,專門挖掘攻擊目標最有價值的信息。調用 Gemini、DeepSeek 等模型,入侵後自主決策Talos 深入分析後發現,ClosedQuorum 在成功入侵目標設備後,會藉助多個 AI 模型來決策攻擊方案,包括竊取瀏覽器登錄憑證、提取加密貨幣信息、持久化執行惡意軟件,以及向其他設備橫向散播惡意軟件。

GPT-6 Astra搓3D刷屏後,3D生成的競爭規則變了
GPT-6 Astra的出現讓3D生成行業競爭標準從「Production-Ready」轉向「Agent-Ready」,強調生成能力需能被AI Agent理解和調用。影眸Hyper3D推出Agentic Mode,能自主分析雜亂輸入、規劃建模路徑,並支援後續參數化調整、材質替換與動畫預設,同時開放MCP接口讓外部Agent串接3D生成流程。

Claude Opus 5.5突襲!68萬行代碼一天遷完,API價格打8折
Anthropic突襲發布Claude Opus 5.5,在代碼生成、知識工作與計算機操作等基準測試中奪冠,輸出速度較Opus 5提升逾三成,API輸入與輸出價格下調20%,緩存讀取價格更砍六成。該模型能在一日內遷移68萬行代碼,並在安全護欄上與Fable 5.1同級,且Anthropic預告Sonnet 5.5與Haiku 5.5將於數週內接續推出。