阿里發佈Token Plan個人版,Qwen3.8-Max-Preview同步上線
重點摘要
阿里發布Token Plan個人版,並同步上線參數規模達2.4萬億的Qwen3.8-Max-Preview模型,該模型在代碼工程與專業辦公場景展現較強能力。官方推出限時優惠方案,個人版Lite套餐月費39元起,夜間使用更享折扣,藉此降低用戶門檻並加速大模型落地生產力場景。
阿里於7月19日正式推出Token Plan個人版訂閱服務,同時開放最新大語言模型Qwen3.8-Max-Preview的搶先體驗。這項新方案藉由統一的Token計費機制,讓開發者與一般用戶能夠以更靈活的方式取用阿里旗下高性能模型,降低大模型應用的進入門檻。此舉也顯示阿里在大模型商業化與生態布局上邁出重要一步。此次同步亮相的Qwen3.8-Max-Preview參數規模達到2.4萬億,屬於當前業界參數量極大的語言模型之一。根據官方資訊,該模型在程式碼工程、專業辦公室應用等場景中表現出強大能力,能夠處理複雜的開發任務與文件撰寫工作。
阿里也計畫在近期發布正式版本,並延續Qwen系列的開源傳統,屆時將對外開放模型原始碼與權重,讓更多研究人員與開發者能夠深入使用。Token Plan個人版是阿里為了讓不同需求的用戶都能輕鬆體驗最新模型而設計的付費方案。用戶可透過Token Plan平台直接使用Qwen3.8-Max-Preview,無需額外申請或排隊。為吸引早期使用者,阿里同步推出限時優惠,針對個人用戶提供三種套餐選擇:Lite版每月新台幣39元、Standard版每月139元、Pro版每月499元,不同層級對應不同的Credits額度與功能範圍。
針對團隊協作需求,Token Plan也提供團隊版方案,分為標準、高級與尊享三種席位,價格分別為每個席位每月150元、550元與1398元,便於不同規模的開發團隊或企業根據使用量與成員人數彈性選購。這些訂閱方案都旨在讓用戶以可預測的固定成本,長期使用阿里的大模型服務。除了價格優惠,阿里還針對Qwen3.8-Max-Preview推出限時體驗活動,白天時段用戶消耗Credits僅需支付原價的一折,大幅降低測試與開發成本。個人版Token Plan用戶若在夜間時段使用,還能在此1折的基礎上再享有額外折扣,讓開發者與研究人員能以極低成本進行大量實驗與調試。值得留意的是,Qwen3.
8-Max-Preview並不限定只能在Token Plan平台上使用。阿里旗下的AI程式開發工具Qoder與QoderWork已經率先支援該模型,開發者可以直接在編碼環境中呼叫模型能力,提升程式撰寫與除錯的效率。同時,阿里旗下的千問PC端用戶也獲得免費體驗該模型的機會,一般使用者無需付費即可嘗試這款新模型的對話與問答功能。當前大模型市場的競爭已不再只是單純比拚模型效能,而是轉向模型能力、成本控制與生態建設的綜合較量。阿里透過Token Plan的靈活訂閱、開發工具的原生整合,以及持續的開源策略,逐步擴大Qwen系列模型的應用範疇。
此舉不僅讓開發者更容易在實際工作中導入AI輔助,也為辦公、程式設計等生產力場景帶來更直接的落地效益。整體而言,阿里此次發布Token Plan個人版與Qwen3.8-Max-Preview,代表其在大模型商業化路徑上的新嘗試。透過分層計費、跨工具整合與開源承諾,阿里正試圖在激烈的AI競賽中建立更完整的生態體系,吸引更多開發者與企業用戶加入其平台。業界也持續關注後續正式版本的效能表現,以及開源後社群的反應。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。