林俊暘離職140天,Qwen3.8重回開源,阿里大模型還能打嗎?

重點摘要
林俊暘離職140天後,阿里雲推出Qwen3.8-Max預覽版,以「日更模式」和「限時一折」價格策略搶佔市場。該模型雖重回開源路線,但用戶反饋顯示其在複雜任務穩定性上仍不如GPT-5.6等頭部模型,且阿里內部因商業化壓力正持續調整組織架構。
阿里在歷經前通義實驗室負責人林俊暘離職後的第140天,於7月19日傍晚正式推出Qwen3.8-Max預覽版。這款被外界視為阿里大模型陣營關鍵棋子的產品,選擇以「半成品」姿態亮相,並罕見地承諾以天為單位持續進化,試圖在激烈的市場競爭中搶佔先機。 與此同時,阿里在價格策略上祭出「骨折價」方案。白天調用費用僅需一折,夜間更是低至0.2折,與月之暗面Kimi K3的定價創新高形成鮮明對比。部分用戶觀察到,模型似乎每天都在變得更聰明,但也有一些付費用戶直言,付費是為了穩定可靠的生產力,而非感受每日變動的不確定性。 Qwen3系列是林俊暘在職期間主導開發的產品,Qwen3.5則是他離開前發佈的最後一個版本。然而,該版本的表現與去年9月曾進入大模型盲測榜單LMArena前三的Qwen3-Max Preview相比,出現明顯落差。據《晚點LatePost》報導,阿里內部有高管對這款在除夕夜發佈的模型並不滿意,甚至直言其為「半成品」。林俊暘堅持開源路線,但最終因阿里組織架構調整而離職,引發業界巨大討論,外界也高度關注Qwen系列模型能否持續進化。 從參數規格來看,Qwen3.8-Max總參數量達到2.4萬億,採用MoE(混合專家)架構,是阿里首次突破萬億參數的原生多模態模型。官方數據顯示,在代碼和協同辦公兩大核心場景中,預覽版較前代Qwen3.7-Max分別提升了22.8%和44.4%。值得注意的是,在林俊暘離開後,Qwen3.8-Max將重回開源路線。市場分析認為,阿里或許終於意識到,在模型能力與閉源頭部產品仍有一定差距時,開源是維護口碑與生態的最佳選擇。 **日更版本表現參差不齊,辦公與代碼能力有亮點**
根據官方介紹,相較於上一代旗艦模型Qwen3.7-Max,新模型在代碼工程、專業辦公等核心能力上實現顯著提升,並在全棧開發、數據分析、Office辦公工作流等複雜長程任務中展現出全球領先的綜合能力。為測試其在辦公場景下的表現,有媒體要求模型分析《具身智能發展報告(2025年)》,並回答關於技術實現路徑、投融資特徵及數據可視化方案等問題。Qwen3.8-Max預覽版在經過約10秒思考後,均能給出清晰答案,並輔以表格展示。 在X平臺上,一名獨立開發者使用Qwen3.8-Max預覽版生成了一個極其驚豔的影片。在明確列出功能模塊、交互邏輯、圖像規則與頁面結構後,最終生成的昆蟲效果堪比BBC紀錄片,畫面寫實且專業性強。整個生成過程耗時僅17分鐘,遠低於Kimi K3所需的52分鐘,展現出長任務執行效率上的優勢。 然而,在測試前端生成能力時,模型表現出現瑕疵。當要求生成一個宇宙星系介紹的交互式HTML頁面時,模型雖然滿足基本要求,卻存在明顯的常識性錯誤,例如主要行星圍繞太陽公轉的速度完全一致,相對位置也未發生變化。這顯示模型在非標準化任務上仍存在明顯不足。 從社交平臺用戶反饋來看,Qwen3.8-Max預覽版在創意編程、3D交互、複雜敘事等領域仍有明顯短板。有人將其形容為「裸奔式發佈」——有參數卻沒數據,有口號卻沒證據。阿里選擇用「日更」與「限時一折」的組合拳,換取大規模真實用戶反饋,以完成最後的打磨。這與阿里此前發佈影片生成模型HappyHorse時的策略幾乎一致,先將熱度拉滿,能力後續再慢慢跟上。 一位獨立遊戲開發者分享了他的使用體驗。他認為,在短週期、高頻次交互場景下,Qwen3.8-Max預覽版的單位時間產出效率甚至優於GPT-5.6 Sol,性價比確實能打。但當任務週期拉長到30分鐘級別的連續推理或大規模代碼生成時,其後勁明顯不足,穩定性仍差一口氣。在具體能力維度上,他評估認為GPT-5.6 Sol處於第一梯隊,Kimi K3與GLM 5.2可歸入第二梯隊,而Qwen3.8-Max預覽版則需再降一檔,其核心競爭點更多集中在上下文窗口容量、單位調用成本及響應延遲的綜合平衡。 **搶佔窗口期,阿里為何急於端上Qwen3.8-Max?**
林俊暘離開後,阿里大模型團隊進入微妙的調整期。3月30日至4月2日間,阿里連續發佈三款模型,但全部採取閉源策略,開發者無法下載權重進行本地部署,只能通過阿里雲百鍊平臺調用API。這與Qwen系列過去兩年「開源優先」的傳統形成鮮明對比。 從大模型發佈節奏來看,在2025年底到2026年中這半年裡,Claude、Gemini、Llama等競爭對手都在熱火朝天地推動「4系」甚至「4.5系」旗艦,而Qwen的大版本號依然停留在Qwen3,更新節奏相對克制。阿里並未推出像Qwen4這樣的跨代基座版本,主要集中在推理性能微調與長文本能力優化。 與此同時,阿里2026財年年報首次交出了一份可量化的AI商業化成績單。AI相關產品在阿里雲外部收入中的佔比首次突破30%,達到89.71億元,年化經常性收入(ARR)已超過358億元,其中絕大部分來自百鍊MaaS平臺的API服務收入。阿里集團CEO吳泳銘反覆強調,AI已跨越初期投入,進入商業化回報週期,且未來五年阿里AI基建投入資金將遠超此前承諾的三年3800億元。 鉅額投入的成本壓力,決定了阿里必須在AI商業化上找到確定性的大規模收入來源。而當「賣Token」成為最大收入來源時,一個結構性矛盾隨之浮現:開源旗艦模型本質上是在API付費牆之外,為自己搭建了一個免費替代品。每一個能夠本地部署Qwen的開發者,都天然減少了調用付費API的需求。因此,阿里大模型閉源邊界持續擴大,「中小模型開源、大模型閉源」的雙軌模式逐步成型。 然而,市場沒有給阿里留下太多時間。進入7月,全球AI大模型進入密集發佈窗口期。7月16日,月之暗面發佈擁有2.8萬億參數的Kimi K3,多項代碼評測指標反超GPT-5.6 Sol。DeepSeek V4也在同期推進,以極致性價比策略切入市場。海外方面,OpenAI發佈GPT-5.6系列,xAI推出Grok 4.5,Meta發佈Muse Spark 1.1,谷歌Gemini 3.5 Pro也計劃上線。 在Kimi K3和DeepSeek V4的雙重壓力下,阿里必須搶跑。在Kimi K3發佈僅3天後,阿里迅速推出Qwen3.8-Max預覽版,被外界視為搶佔窗口期的關鍵動作。為了搶這個窗口,Qwen3.8-Max的發佈形式帶著多重「趕時間」的痕跡:後訓練尚未收尾,英文版直接宣稱「僅次於Fable 5」,但中文版卻加上了「可能」二字,並明確承諾開源。 **林俊暘離開後,Qwen3.8-Max為何再度迴歸開源?**
林俊暘離開後,通義實驗室經過三次組織架構調整。3月阿里成立ATH事業群(Alibaba Token Hub),由吳泳銘親自帶隊;4月設立集團技術委員會,吳泳銘任組長、周靖人任首席AI架構師;6月將通義大模型事業部與未來生活實驗室合併,成立Token Foundry事業部,仍由吳泳銘直接負責。三次調整的核心主線,是將AI業務從「技術驅動」的組織形態,逐步改造為「商業化驅動」的Token工廠。 林俊暘離職時,很大程度折射著阿里在「開源信仰」與「商業回報」之間的階段性博弈。如今Qwen3.8 Max預覽版上線,阿里選擇重新許下開源承諾。從時間節點來看,全球市場的開源與閉源力量對比正在發生根本性變化。Mozilla發佈的《開源AI現狀報告》顯示,開源模型與閉源模型的平均性能差距已縮至3.3%,在編碼、指令執行等核心能力上已基本持平。 OpenRouter數據顯示,開源模型處理的Token佔比從2026年1月的34%飆升至6月的65%,全球API調用月消耗量前五名已全部被開源模型包攬。中國大模型更是在全球調用量中連續十一週領跑,開源模型下載量佔比已達41%。在開源生態上,7月22日,「阿里雲開發者」公眾號正式更名為「千問AI平臺」,標誌著阿里正式將Qwen的開發者生態,從過去依賴林俊暘個人魅力維繫的開源互動,轉移到了一個由阿里官方直接運營、提供標準化服務的統一平臺上。 整體來看,Qwen3.8-Max正式版上線後選擇迴歸開源,並非簡單的路線回調。這是阿里在經歷內部路線分歧後,重新認清自身優勢,並在當下激烈的市場競爭中做出的商業選擇。
Related
相關文章

華為盤古2號位創業,三個月估值漲10倍
# 華為盤古大模型前核心成員創業,比特無限三個月估值飆升10倍 一家專注於AI生成物理3D模型的年輕公司正迅速崛起。成立僅一年多,由前華為盤古大模型二號位周平義博士聯合創辦的「比特無限(BitInf)」,在短短三個月內估值暴漲10倍,接連完成三輪融資,累計金額達4500萬元,集結了卓源亞洲、容億投資、普華資本、壹德資本等知名機構。就在不久前,央視在世界人工智能大會(WAIC)期間對這支全90後團隊進行了專題報道,將其從「水下」狀態推至聚光燈下。

OpenAI 上線 ChatGPT Health:接入蘋果 Health 等數據,每週超 3 億人詢問健康問題
首頁 > 智能時代>人工智能 OpenAI 上線 ChatGPT Health:接入蘋果 Health 等數據,每週超 3 億人詢問健康問題 2026/7/24 10:06:57 來源:IT之家 作者:故淵 責編:故淵 評論: 感謝IT之家網友 Nuc_F 的線索投遞!

Token燒不起,大廠控成本,給AI製藥也算一筆經濟賬
Token烧不起,大廠控成本,給AI製藥也算一筆經濟賬 過去半年,互聯網大廠集體陷入對AI投入的“成本焦慮”。百度短暫發佈又撤回token計費新規,字節跳動的AI業務面臨更嚴苛的回報審視,京東、阿里相繼傳出壓縮非核心AI團隊的消息。這波降溫並非AI賽道遇冷,而是管理層開始正視一個現實:模型越跑越貴,變現路徑卻遠未明朗,燒錢的速度正觸及容忍邊界。 大廠算AI經濟賬,問到底是一個問題:花出去的錢,能不能換來可量化商業價值?如今,這股“算賬風”正向醫療領域吹來。

GPT-5.6證偽30年圖論猜想,北大校友5天連破6題
# 30年圖論猜想被AI推翻!GPT-5.6驚天反例曝光,人類數學家面臨「失業」危機? 就在今天,一則消息在數學界與AI圈同時炸開:GPT-5.6 Pro成功證偽了圖論領域一個懸而未決長達30年的猜想——Dinitz-Garg-Goemans(DGG)成本問題。與此同時,一位北大校友藉助GPT-5.6 Sol在五天內連續攻克六道開放已久的Erdős難題。這兩起事件疊加,讓即將揭曉的菲爾茲獎蒙上一層「最後一屆人類獎」的陰影。

為什麼現在遊戲對AI更重要了
隨著生成式AI與大語言模型快速發展,遊戲產業的角色正在從單純的娛樂載體,轉變為AI技術落地與迭代的關鍵試驗場。過去,遊戲主要為強化學習提供模擬環境,例如AlphaGo透過棋類遊戲訓練策略;如今,AI需要更複雜的互動場景來驗證推理、規劃與多模態能力,而開放世界遊戲正好能提供動態、開放的物理與社會規則系統,讓模型在近乎真實的環境中學習因果關係與長期決策。

谷歌旗艦大模型難產背後:軍方合作引員工不滿,內部感嘆“已落後”
谷歌旗艦大模型Gemini 3.5 Pro因員工士氣低落、與軍方合作引發辭職潮而延遲發布,內部感嘆已落後競爭對手。公司否認士氣問題影響研發,但人才流失與投資壓力已引發市場對其AI資本支出回報的擔憂。