鈦媒體生成式AI

微信、支付寶會給豆包手機“開門”嗎?AI手機背後的入口之爭

2026年8月3日 11:33
微信、支付寶會給豆包手機“開門”嗎?AI手機背後的入口之爭

重點摘要

如果這些規則沒有明確,即使技術接口存在,超級App們也沒有動力把最有價值的部分交給一個可能架空自己的外部Agent。如果豆包遲遲無法拿到阿里和騰訊等企業的深度授權,字節並非完全沒有退路。相比其他公司,字節最大的優勢之一,是它本身已經擁有一套規模龐大的互聯網產品生態。在內容領域,字節擁有抖音和今日頭條;在辦公與創作領域,擁有飛書、剪映等工具;在消費場景中,抖音電商和抖音生活服務也已經形成了相當規模的商品和本地商戶供給。

站內 AI 整理稿

如果這些規則沒有明確,即使技術接口存在,超級App們也沒有動力把最有價值的部分交給一個可能架空自己的外部Agent。如果豆包遲遲無法拿到阿里和騰訊等企業的深度授權,字節並非完全沒有退路。相比其他公司,字節最大的優勢之一,是它本身已經擁有一套規模龐大的互聯網產品生態。在內容領域,字節擁有抖音和今日頭條;在辦公與創作領域,擁有飛書、剪映等工具;在消費場景中,抖音電商和抖音生活服務也已經形成了相當規模的商品和本地商戶供給。如果這些字節內部的業務率先向豆包手機開放,則可以讓系統級Agent的豆包實現部分能力,成為豆包手機的基本盤。但這條退路存在明顯的上限。抖音電商無法完全替代淘寶、京東和拼多多在商品品類、物流與用戶習慣上的積累;抖音生活服務也無法覆蓋即時配送、打車和完整出行鏈路。更難替代的是社交與支付。微信所掌握的人際關係和聊天網絡,並不是字節通過增加幾個功能就能迅速複製的。豆包也很難僅依靠字節系生態,覆蓋支付寶和微信支付已經深入的線上線下場景。因此,字節系生態可以幫助豆包手機完成冷啟動,卻難以單獨支撐“一句話操作所有服務”的完整願景。更現實的路徑,可能是一套混合式架構。系統設置、文件整理、相冊、日程以及字節系應用,由豆包依靠系統原生權限和內部協議直接執行;普通合作應用通過MCP或者API開放能力;社交、支付等高敏感服務,則通過A2A或者AHA等方式,與平臺自有Agent完成任務交接。這套方案不會像初代豆包手機那樣,看上去可以自由操作所有App,更接近倪飛在WAIC群訪中所強調的商業化路徑:“商業化不是把一個能夠運行的Demo裝進手機,而是讓一項技術經受長期、高頻和複雜的真實使用。“相比不受限制地操作所有應用,一套權限更加剋制、執行邊界更加清晰的混合架構,反而更可能讓豆包手機成為一款能夠穩定銷售和長期使用的消費級產品。過去十幾年,智能手機更像一個App啟動器:用戶打開不同應用,再進入內部完成服務。豆包手機所代表的Agent模式,則希望讓系統直接理解需求、拆解任務,並調度相應的平臺和服務。理想情況下,系統Agent負責理解和調度用戶需求,阿寶、小微等平臺Agent負責各自生態內的服務、賬號與交易,各方通過協議、授權和利益分配機制完成協作。現實也可能走向割裂。騰訊、阿里、字節和手機廠商分別建設自己的Agent生態,App時代的平臺圍牆隨之升級為協議圍牆。若頭部平臺始終不開放社交、支付和交易等核心能力,豆包即使能夠調用系統功能和部分合作應用,也可能停留在增強型語音助手和跨應用工具的階段。因此,豆包手機二代需要證明的,已經不只是AI能否完成任務,還包括字節能否獲得其他平臺長期、穩定的調用權限。當AI開始替用戶操作手機,移動互聯網的入口不會消失,只會重新劃分,而豆包已經走到了談判桌前。

Related

相關文章

量子位生成式AI

賽博義父Tibo爆料:谷歌早一年就做出了ChatGPT,硬是沒敢發!

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> 賽博義父Tibo爆料:谷歌早一年就做出了ChatGPT,硬是沒敢發! Jay 2026-08-03 12:29:44 來源:量子位 終究還是喜提了「美國豆包」 Jay 發自 凹非寺 量子位 | 公眾號 QbitAI 啥,谷歌真比OpenAI還早一年搞出了ChatGPT? 不是谷歌事後找補了,這次是OpenAI自己人,Codex負責人Tibo剛佐證的消息: 那就是早一年版的ChatGPT。最初叫LMChat,後來又換了另一個代號。 谷歌太緊張了,不敢發佈它,而DeepMind則被禁止推出可能衝擊谷歌業務的產品。 但Tibo為啥對這段陳年舊事如此瞭如指掌? 答案是:他當時就在那支谷歌團隊裡。 我當時就是那個團隊的一員。 是的,如今為OpenAI打造「無限Token」的Tibo,正是當年穀歌那個項目的親歷者。 網友都震驚了,Tibo還有這麼一段經歷: 不er,我還以為你只是個Codex的重置按鈕(bushi)。 Jeff Dean:我不甘心啊!! 事情是這樣的,一名Midjourney工程師,最近在X上翻出了前谷歌大腦負責人Jeff Dean的一段舊採訪: 我有時會想Jeff Dean的那次採訪,他說他們在ChatGPT之前就有一個內部的Chatbot,但覺得用它還不如直接用谷歌搜索。 沒想到Tibo親自下場回覆,和Jeff Dean來了波隔空對話: Jeff說的那個項目確實存在,最初叫LMChat,幾乎就是一個早了一年的ChatGPT。 至於為啥沒發出來,Tibo無奈地表示,DeepMind沒這權限啊,LLM會衝擊谷歌搜索,老闆們緊張壞了,不給拍板。

剛剛

生成模型也能端到端訓練了?核心竟是一個for循環

2012年,AlexNet以一場壓倒性的勝利終結了一個時代。在此之前,圖像識別依賴於人工精心設計的一層層特徵提取流程;AlexNet則證明了一件後來被反覆驗證的事:將整個任務端到端地交給模型自己學習,幾乎總能勝過人類設計的分階段流水線。從圖像分類到目標檢測再到圖像分割,深度學習的每一次躍遷背後,都離不開「讓它自己一口氣學完」這個核心思路。 然而,有一個領域始終是例外:生成模型。當今最強、最具擴展性的生成模型,無論是自迴歸還是擴散模型,都不是端到端的。

剛剛

數百萬本書,被Claude “閱後即焚”

Anthropic為了讓AI讀完人類的書籍,採取了特殊做法,先讓這些書不再以書的形式存在。此舉涉及數百萬本書,透過「閱後即焚」的方式處理,以利AI進行閱讀與學習。

剛剛

王慧文家族辦公室押注的AI版圖:從大模型到AI Agent

王慧文家族辦公室Lollapalooza Capital已投資24個AI項目,從大模型公司月之暗面到AI Agent創業公司蝴蝶效應,覆蓋AI基礎設施、內容生成、教育和硬體等產業鏈關鍵環節。這顯示其投資布局從早期的大模型能力競爭,逐漸轉向AI應用落地與生態建設。

剛剛

天下苦閉源模型久矣,MiniMax要做多模態領域的Deepseek

MiniMax發布多模態生成模型H3,支援2K解析度、15秒影片生成,性能與Seedance 2.5相當,但定價僅每秒0.8元人民幣,具備價格競爭力。H3將開源,打破影片生成市場由閉源模型主導的局面,可私有化部署,有望取代部分傳統後製工序。

剛剛
鈦媒體生成式AI

天下苦閉源模型久矣,MiniMax要做多模態領域的Deepseek

MiniMax發布新一代多模態生成模型H3,支援2K解析度與原生雙聲道,性能與Seedance 2.5同級,但每秒定價僅0.8元人民幣,並宣布數日內開放模型權重。H3透過自研VAE與全模態理解管線降低算力成本,能一次生成含配音、字幕與動效的成片,可能取代部分傳統後期工序。此舉打破視頻生成市場由閉源模型主導的局面,為中小團隊與重視數據主權的B端客戶提供新選擇。

剛剛