豆包開始收費了,字節到底有沒有商業化的壓力

重點摘要
豆包開始收費了,字節到底有沒有商業化的壓力 2026年6月24日,字節跳動旗下AI產品豆包正式推出專業版訂閱服務,提供68元、200元與500元三檔月費方案。消息一出,市場迅速分裂成兩種聲音:一邊是用戶感嘆「免費時代結束了」,甚至質疑「比ChatGPT還貴」;另一邊則是業內觀察者意味深長的評論——「字節終於開始算賬了」。這兩種反應都指向同一個核心疑問:字節跳動究竟有沒有商業化的壓力?豆包收費,是戰略性的變現布局,還是被迫止血的自救之舉?
豆包開始收費了,字節到底有沒有商業化的壓力
2026年6月24日,字節跳動旗下AI產品豆包正式推出專業版訂閱服務,提供68元、200元與500元三檔月費方案。消息一出,市場迅速分裂成兩種聲音:一邊是用戶感嘆「免費時代結束了」,甚至質疑「比ChatGPT還貴」;另一邊則是業內觀察者意味深長的評論——「字節終於開始算賬了」。這兩種反應都指向同一個核心疑問:字節跳動究竟有沒有商業化的壓力?豆包收費,是戰略性的變現布局,還是被迫止血的自救之舉?今年5月,一則傳聞在社交平台瘋傳,稱「字節悄悄砍掉了30%的AI項目,2025年AI推理成本超過80億,是營收增量的2.3倍,公司現金流撐不到2027年」。
字節員工隨即回應「太假了」,業界也普遍認為該消息荒謬至極。浙商證券數據顯示,字節2024年AI投入超過800億元;《南華早報》則報道其2026年AI基礎設施預算超過2000億元。有業內人士比喻:一個準備花2000萬裝修的富豪,看到上個月水電費交了80塊,就跟全家宣布撐不下去了——這個邏輯顯然站不住腳。闢謠雖有理有據,但真正值得關注的並非傳聞本身,而是它在行業內引發的共鳴。曾任職阿里15年、後來擔任飛書產品副總裁、如今自立門戶創辦AI公司的玉伯,在虎嗅專訪中直言「用互聯網思維做AI產品是死路一條,AI產品沒有規模效應」。這句話之所以分量重,在於他親身經歷了阿里與字節的體系,深知流量思維的侷限。
豆包如今的困境——免費用戶越多虧損越大、付費意願被免費習慣鎖死、廣告模式在AI上難以落地——全都源於「用互聯網思維做AI」這個起點。《中國企業家》雜誌在6月26日發布的深度報道揭露了兩組關鍵數據:豆包日活躍用戶超過2億,但日收入不足百萬元;豆包大模型日均Token調用量已突破180萬億,一年內增長超過10倍。一位AI基礎設施領域的創始人直言,如果繼續保持這樣的用戶增長,算力消耗可能耗盡字節的資源。火山引擎總裁譚待在採訪中雖然試圖淡化焦慮,表示沒有評估過算力賬本,卻也承認了另一個細節:外界流傳的Seedance收入數據都是錯的,而且偏高,「我壓力很大,財務天天問我是不是藏數了。」
從集團層面看,字節的財務趨勢同樣值得警惕。據《金融時報》報道,字節2025年資本開支約1500億元;《南華早報》指出其2026年AI基礎設施預算超過2000億元,這相當於吃掉了2025年利潤的六成。抖音年廣告收入約4000億元,但AI一年就要燒掉近2000億元,再扣除TikTok海外投入及各業務線運營成本,利潤空間被嚴重擠壓。與此同時,多個增長引擎同步減速:抖音月活達10.09億,同比僅增長14.43%;抖音電商GMV增速從2022年的320%持續放緩至2025年的30%左右。收入曲線趨平,成本曲線陡峭,此時需要關心的已不是會不會出事,而是能扛多久。
回到豆包自身,收費的最直接理由來自收入與成本之間巨大的剪刀差。截至2026年上半年,豆包每天收入不足百萬元,主要來自電商佣金;3.45億月活用戶,每人每天貢獻不到0.003元。成本端,據火山引擎披露的數據,豆包大模型日均Token調用量已突破180萬億。業界估算,即使按最便宜的模型計算,單日推理成本也在1.3到2.4億元之間,一年就是數百億。
更大的問題在於用戶結構:QuestMobile數據顯示,2026年一季度AI應用新增用戶呈「下沉+銀髮」雙向延伸;花旗調研指出,豆包用戶中學生與中老年群體佔大頭,每日使用時長不足一小時,真正有高頻生產力需求的職場人、開發者又認為豆包專業能力不夠,更傾向於使用ChatGPT、Claude或國內的Kimi。調查還顯示,45%的受訪者願意付費,但可接受的月均價格僅為48.3元,而豆包標準套餐起價68元,比心理價位高出約20元。這形成了「低端用戶用不上,高端用戶看不上」的尷尬局面。放眼行業,真正在AI上跑通商業化的公司走的都是另一條路。Anthropic企業採用率已達34.
4%,年收入飆升至450億美元,80%以上來自企業服務;OpenAI雖然擁有9億周活用戶,但付費率不到6%,每實現1美元收入需投入1.6到2.25美元。國內方面,阿里千問嵌入雲與電商生態,騰訊元寶依託微信社交支付,兩者都不直接依賴C端訂閱。真正在C端訂閱上跑出成績的是Kimi,其年度經常性收入已達2億美元。百度文心一言的做法值得一提。2023年11月,百度在產品上線僅8個月後就推出59.9元/月的專業版,成為國內第一個向C端收費的大模型產品。當時正值行業燒錢換增長的狂熱期,百度反其道而行,用付費牆篩選用戶。
回頭看,這套邏輯有其先見之明:每多一個免費用戶就多一筆虧損,付費能避免算力無效消耗,提前鎖定最有價值的用戶。2025年2月,百度因DeepSeek免費策略衝擊而宣布文心一言全面免費並退費,但那是完成階段性使命後的主動轉向。豆包收費則完全不同——它是在用戶規模觸頂、成本壓力爆表後的被動應對,一個是「先篩選再服務」,一個是「先免費再收割」。DeepSeek的定價為這個對比加上最後一筆註腳。據澎湃新聞報道,DeepSeek V4-Pro已宣布永久2.5折定價,百萬tokens輸出僅6元,緩存命中輸入低至0.025元;而火山引擎公布的豆包2.1 Pro每百萬tokens輸出價格為30元,緩存命中1.
2元。兩者成本差距可達5倍到60倍。對豆包用戶來說,每月花68元訂閱,還是花更少的錢買DeepSeek API接入其他應用?當用戶遷移成本接近於零,這個價格差很難用生態或品牌來彌補。回到核心問題:字節到底有沒有商業化壓力?答案不是「現金流危機」,而是真實的增長焦慮。字節仍是中國最賺錢的互聯網公司之一,但「有錢」不代表「商業模式跑通了」。豆包每日收入不足百萬,算力成本卻高達數千萬乃至上億,火山引擎的ToB業務增長遠遠追不上C端推理成本的膨脹速度。
字節長期依賴的「流量稅」模式——用海量用戶注意力向廣告主收費——在AI時代面臨根本性挑戰:GPU集群的邊際成本不降反升,「越多用戶越多虧損」取代了「越多用戶越低成本」。多家媒體援引知情人士稱,豆包在2026年不會將付費用戶滲透率作為核心考核指標。這個細節比定價方案本身更能說明問題:字節沒有指望靠訂閱一夜抹平虧空,而是要進行一次謹慎的商業化試水——驗證中國用戶是否願意為AI助手買單,願意花多少錢,買了之後會不會續費。這次試水的結果,不僅關乎豆包一個產品,更測試著字節能否在「流量換廣告」的舊模式之外找到新路。
用戶增長見頂、廣告收入增速放緩、AI成本邏輯與移動互聯網截然相反——豆包收費是字節交出的第一份答卷。分數如何,就看續費率了。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
騰訊雲開源 TencentDB Agent Memory v2.0:專為 AI 編碼代理打造的團隊級記憶中樞
Tencent Cloud has open-sourced TencentDB Agent Memory v2.0, a team-level memory hub for AI agents. The idea is super simple: if project context was already explained once, a new session should not need it repeated.
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。