剛剛,阿里Qwen3.8-Max來了!衝進全球第一梯隊,模型表現直逼Claude

重點摘要
阿里巴巴突襲發表新一代基座大模型Qwen3.8-Max,總參數量達2.4兆,在編程、專業工作、長程任務與多模態分析等場景表現亮眼,於Arena榜單衝進全球第一梯隊,直逼Anthropic的Claude系列,部分程式能力甚至超過Claude Opus 5。官方並以低於國際大模型的價格策略(輸入每百萬Tokens人民幣12元等)吸引用戶,多位搶先體驗的網友也稱讚其性價比高、能自主完成從需求到交付的完整專案。
阿里巴巴日前無預警發表新一代基座大模型 Qwen3.8-Max,總參數量高達 2.4 兆,主打在編程、專業工作、長程任務與多模態智能體等場景的全面進化。模型一登場便在權威第三方評測榜單 Arena 中一舉擠進全球第一梯隊,整體表現直逼 Anthropic 的 Claude 系列,其中在編程領域甚至超越 Claude Opus 5 與 Fable 5 的 High 版本,引發市場高度關注。 這款新模型的定價策略同樣來勢洶洶。官方公布的費率顯示,國內每百萬 Tokens 輸入為 12 元、輸出為 36 元,隱式緩存命中時輸入價格更僅需 1.5 元;至於國際價格,輸入與輸出費用分別僅為 Opus 5 的 40% 與 24%。如此一來,等於以相對親民的價格,提供接近頂級模型的表現,讓「性能強」與「負擔得起」這兩項條件首次同時成立。 事實上,在正式發表之前,已有不少開發者搶先體驗 Qwen3.8-Max 預覽版。有人用它從零開始復刻出一版《憤怒的小鳥》,實際使用一週後,額度消耗不到九成,並直言價格確實合適;也有創作者僅靠一條提示詞,就成功打造出完整且可互動的開發者作品集,對整體成果讚譽有加。更有測試者觀察到,Qwen3.8-Max 在基準測試中的數據甚至碾壓競品 5.6-Sol,讓外界對其他閉源高價模型的期望產生動搖。 為了實際驗證這款模型的能耐,媒體也針對其主打能力進行多輪實測。首先考驗的是 AI Coding 能力,在一份接近正式產品規格的需求文件要求下,Qwen3.8-Max 歷時約五分鐘,便交付了一個具備完整功能的 AI 資訊網頁。過程中從需求拆解、技術選型、項目結構到功能實作,每個環節都井然有序。最令人驚艷的是,模型還額外整理了一份「問題與解決記錄」,將開發過程中遇到的報錯與修復過程一一列出,甚至在交付前自行執行功能驗收,從安裝依賴、本地啟動到生產建置與預覽,全面確認專案可運行性,全程無需人工介入。 除了程式開發,長文本交叉分析也是 Qwen3.8-Max 的強項。測試團隊餵入一篇由 AI 大神卡帕西參與撰寫、厚達數十頁的學術論文,內容涵蓋正文、圖表與附錄,並要求模型比較 ILSVRC 與 PASCAL VOC 兩套電腦視覺評測基準的難易度。這道題目的困難之處在於,答案分散於章節、表格與圖表之中,必須進行跨區塊比對才能得出結論。Qwen3.8-Max 只花了約 33 秒,便給出明確判斷:若只看整體平均值,PASCAL VOC 似乎較難,但若深入檢視可比類別與 ILSVRC 的困難子集,ILSVRC 在多項定位難度指標上反而更接近甚至超越 PASCAL。模型不僅論述有據,還自動生成了一份詳盡的分析報告,將原文表格直接抽出作為佐證,定位精準度令人印象深刻。 多模態內容理解同樣是此次測試重點。媒體將一集長度接近 70 分鐘的影片播客交給 Qwen3.8-Max,內容涵蓋 Sam Altman 從 AI 創業一路談到 OpenAI 戰略與未來社會等龐雜主題。模型在短短兩三分鐘內,便生成了一份依核心觀點劃分的完整主題時間軸,每個話題都採用「先總結、再展開」的結構,並一一對應到原始片段的時間戳。這項能力讓使用者可以直接跳轉至感興趣的段落,省去大量手動查找的時間。 從實際表現來看,Qwen3.8-Max 的定位已經不只是「生成工具」,而是具備端到端交付能力的 AI 助手。它能從零開始推進一項完整工程,過程中自主解決問題,最終交出可運行、可驗證的成果,這樣的整合能力在目前模型市場中實屬罕見。而這樣的底氣,來自於阿里在開源領域的長期布局。自 2023 年啟動開源以來,Qwen 家族已累計釋出超過 400 個模型,衍生模型數量突破 20 萬個,總下載量超過 10 億次,是目前全球規模最龐大的開源大模型體系。 更重要的是,Qwen 的迭代節奏幾乎未曾停歇。從 Qwen3、Qwen3.5 到如今的 Qwen3.8,每一代都讓更多應用場景從「想像」走向「實用」:從基礎推理延伸到程式開發、專業工作、多模態理解與長程 Agent 任務,進而推展至如今的端到端交付。這種穩健而密集的更新頻率,放眼全球也少有敵手,也讓「模型能力、場景覆蓋與價格」這組過去難以兼得的三角關係,首次有了同時滿足的可能性。 目前,Qwen3.8 的 API 已正式上線千問 AI 平台,同時也接入阿里同步推出的 Agent 產品「千問辦公」,有興趣的使用者可直接前往相關平台實際體驗。
Related
相關文章

當品牌開始爭奪AI的答案:翰智GEO入場
AI已取代搜尋引擎成為用戶獲取資訊的主要管道,品牌在AI問答中的形象變得更重要,GEO(生成式引擎優化)因而興起。央視「3·15」晚會揭露黑帽GEO亂象後,中國信通院發布行業標準,中央網信辦也啟動專項整治,合規與可信成為GEO入場門檻。企業級服務商翰智推出智慧版GEO業務,以可量化、可溯源、可驗收的工程化打法,搶進這條新賽道。

沐曦曦雲 C 系列 GPU 實現 Day 0 適配 MiniMax H3 多模態生成模型
沐曦股份宣布旗下曦雲 C 系列 GPU 完成對稀宇 MiniMax H3 多模態生成模型的 Day 0 適配,可快速部署並運用其多模態創作能力。此系列 GPU 採用自研架構,透過全棧自研 MXMACA 軟體棧,原生相容 PyTorch、TensorFlow 等 40 餘種主流 AI 框架,並支援超過 500 個 AI 模型穩定運行。

數億元!螞蟻AGI研究中心主任大模型創業,拿下新融資
杭州大模型公司西湖心辰宣布完成數億元人民幣B+輪融資,由廣發信德領投,螞蟻集團等老股東支持,資金將投入擴散語言模型研發、多模態實時互動產品迭代及海外市場拓展。該公司由現任螞蟻集團通用人工智能研究中心主任藍振忠創立,專注擴散範式大模型,並已在全球市場建立商業化閉環。

Day-0 支持,摩爾線程完成 MiniMax H3 多模態生成模型適配
首頁 > 智能時代>人工智能 Day-0 支持,摩爾線程完成 MiniMax H3 多模態生成模型適配 2026/8/3 13:19:15 來源:IT之家 作者:浩渺 責編:浩渺 評論: 感謝IT之家網友 華南吳彥祖 的線索投遞! IT之家 8 月 3 日消息,今日,MiniMax 正式開源多模態生成模型 MiniMax H3。

阿里Qwen3.8正式發佈,編程與辦公再進化,推理更快更穩定
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> 阿里Qwen3.

賽博義父Tibo爆料:谷歌早一年就做出了ChatGPT,硬是沒敢發!
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> 賽博義父Tibo爆料:谷歌早一年就做出了ChatGPT,硬是沒敢發! Jay 2026-08-03 12:29:44 來源:量子位 終究還是喜提了「美國豆包」 Jay 發自 凹非寺 量子位 | 公眾號 QbitAI 啥,谷歌真比OpenAI還早一年搞出了ChatGPT? 不是谷歌事後找補了,這次是OpenAI自己人,Codex負責人Tibo剛佐證的消息: 那就是早一年版的ChatGPT。最初叫LMChat,後來又換了另一個代號。 谷歌太緊張了,不敢發佈它,而DeepMind則被禁止推出可能衝擊谷歌業務的產品。 但Tibo為啥對這段陳年舊事如此瞭如指掌? 答案是:他當時就在那支谷歌團隊裡。 我當時就是那個團隊的一員。 是的,如今為OpenAI打造「無限Token」的Tibo,正是當年穀歌那個項目的親歷者。 網友都震驚了,Tibo還有這麼一段經歷: 不er,我還以為你只是個Codex的重置按鈕(bushi)。 Jeff Dean:我不甘心啊!! 事情是這樣的,一名Midjourney工程師,最近在X上翻出了前谷歌大腦負責人Jeff Dean的一段舊採訪: 我有時會想Jeff Dean的那次採訪,他說他們在ChatGPT之前就有一個內部的Chatbot,但覺得用它還不如直接用谷歌搜索。 沒想到Tibo親自下場回覆,和Jeff Dean來了波隔空對話: Jeff說的那個項目確實存在,最初叫LMChat,幾乎就是一個早了一年的ChatGPT。 至於為啥沒發出來,Tibo無奈地表示,DeepMind沒這權限啊,LLM會衝擊谷歌搜索,老闆們緊張壞了,不給拍板。