字節兩員離職大將,單挑老東家?

重點摘要
字節跳動旗下的 AI 影片生成產品即夢 AI,一直以來在業界佔據領先地位,除了仰賴大模型技術的不斷精進,更關鍵的是字節本身強大的分發渠道。在陸續整合豆包與 CapCut 之後,即夢 AI 的流量始終位居行業前茅,而 Seedance 2.0 上線後,更迎來新一波成長高峰。就在即夢 AI 吞下市場大半版圖的此刻,兩款由前字節跳動高管創立的後起之秀,正引發業界高度關注。
字節跳動旗下的 AI 影片生成產品即夢 AI,一直以來在業界佔據領先地位,除了仰賴大模型技術的不斷精進,更關鍵的是字節本身強大的分發渠道。在陸續整合豆包與 CapCut 之後,即夢 AI 的流量始終位居行業前茅,而 Seedance 2.0 上線後,更迎來新一波成長高峰。就在即夢 AI 吞下市場大半版圖的此刻,兩款由前字節跳動高管創立的後起之秀,正引發業界高度關注。2025 年 6 月上線的「拍我 AI」出自愛詩科技,創辦人兼 CEO 王長虎曾在字節跳動擔任 AI Lab 視覺負責人,從零打造抖音與 TikTok 的視覺技術體系。
愛詩科技於 2026 年 7 月宣布完成整體 C 輪融資,累計募資達 29.8 億元人民幣,背後投資方包括阿里巴巴(多輪領投)、鼎暉投資、中國儒意、三七互娛等。另一款產品 LiblibTV 則於 2026 年 3 月上線,來自演語科技,創辦人陳冕曾任字節跳動剪映與 CapCut 的全球商業化負責人,也是字節內部最年輕的 4-1 級高管。演語科技在 2026 年 6 月宣布完成近 3 億美元的 B+ 輪融資,估值突破 20 億美元,創下國內 AI 應用賽道的融資紀錄,該輪由 Granite Asia、騰訊、順為資本聯合領投,HT Investment、時代資本跟投,高榕、螞蟻等老股東亦持續加碼。
兩款產品問世不久便如此吸睛,外界不禁好奇,這對「前字節系」的創業者,能否挑戰甚至超越老東家。當字節遇上自家離職大將,這場「徒弟對師傅」的較量,究竟誰能勝出?雖然同屬 AI 影片生成領域,但拍我 AI 與 LibTV 走的是截然不同的路線。LibTV 更像一個模型聚合平台,除了使用字節的 Seedance 大模型,也接入了快手的可靈(Kling),透過合理的工作流設計與多種 skill 組合來產出影片。而拍我 AI 則採用自研模型 Pixverse,近期雖也接入了 Seedance 2.0,但研發重心仍放在自有模型上。歸根結底,兩者在基礎技術層面代表了 Seedance 與新晉大模型的直接碰撞。
根據 Tech 星球進行的實測,在 LibTV 使用其內建的 Seedance 2.0 模型,在拍我 AI 使用愛詩科技自研的 Pixverse V6 模型,分別生成相同提示詞的影片,藉此比較兩者對指令的理解程度與畫面品質。第一個測試要求生成一支動漫風格的馬斯克在美加墨世界盃看比賽的影片。拍我 AI 的第一版人物過於削瘦,下巴線條明顯,與馬斯克形象出入較大,且背景完全不像世界盃現場,反而更像電競場地。進一步要求將場景換為更明顯的世界盃賽場並加入進球場景後,場景對了,但人物位置錯亂,進球時突然切換到足球場上,人物反應也較慢。
後來將兩次提示詞合併,場景與動線基本準確,但人物面部已完全不符合提示詞,衣服也換成夾克,既非日常西裝也非球衣,且仍存在人物位置切換不穩定的問題。相比之下,LibTV 生成的影片人物更精準,符合馬斯克的外貌特徵,身穿球衣融入場景,表情變化與情節匹配,但人物表情略顯誇張,手中的旗子與手套稍嫌突兀,鏡頭也較單一。再要求加入進球場景後,情節依然符合邏輯。第二個測試要求生成機器人在舞台上跳芭蕾舞的影片,拍我 AI 對場景的體現仍不準確,未明確展現舞台要素,而 LibTV 則完整呈現了舞台。
從實測可看出,對無技術基礎的使用者而言,Pixverse V6 畫面與細節較豐富,但容易忽略提示詞中的元素,且可能產生不合常理的內容,需要不斷調整描述來增加精細度;Seedance 2.0 執行指令較完整,邏輯相對順暢,但在細節上仍不穩定。在操作層面,拍我 AI 只能選擇單一模型,但操作方式簡單,無門檻,目標用戶更廣泛;LibTV 則可結合多種模型,操作流程流暢,更能適應專業用戶,從選擇 skill 或輸入提示詞、工作流展示到節點修改,都非常清晰,在模型落地方面表現較佳。
此外,兩者內建的模板與 skill 也各具特色:拍我 AI 的模板偏向豎屏創意類,符合短影片邏輯;LibTV 的 skill 則偏向長影片風格,專業度上限較高。由於創辦人背景不同,兩家公司的產品策略也截然不同。王長虎的技術出身,使愛詩科技將重點放在模型研發上;而陳冕在剪映的經歷,則讓他更擅長增長與商業化。目前愛詩科技的核心產品除了自研大模型,就只有拍我 AI 及其海外版 Pixverse,全球用戶超過 1.5 億,覆蓋 177 個國家與地區,但月活躍用戶長期維持在 1500 萬左右,年化收入超過 4000 萬美元。
演語科技則擁有 LiblibAI、星流 / Lovart、LibTV 等多個產品,且數據表現不俗:LiblibAI 累計用戶超過 3000 萬,年化收入突破 3 億美元;Lovart 上線 5 個月年化達 8000 萬美元;LibTV 上線首日用戶突破 10 萬,兩個月後月收入增長超過 13 倍。拍我 AI 的主要優勢在於底層技術高度自主,對上游依賴較小,抗風險能力較強,儘管模型目前尚不完善,但已將技術掌握在自己手中。不過挑戰也在於模型本身,要與字節即夢抗衡,必須突破技術瓶頸,而目前其自研模型與 Seedance 仍有一段差距,要追上老東家還需時間。另一方面,LibTV 的核心優勢在於價格。
2026 年 4 月,即夢因算力稀缺連續三次調漲價格,影片生成成本翻了近 6 倍,同樣能調用 Seedance 2.0 的 LibTV 因此成為許多 AI 影片從業者的「平替」選擇。LibTV 至尊版年費 11999 元,每月提供 66000 積分;即夢 AI 超級會員年費 30576 元,每月僅提供 54600 積分,價差相當顯著。然而 LibTV 的低價主要靠大量補貼維持,並非長久之計。此外,作為模型聚合平台,LibTV 在基礎技術層面完全依賴上游大模型,一旦上游模型發生變化,將直接影響其資金鏈與產品品質,與背靠字節大模型的即夢相比,抗風險能力與發展空間都較低。
對於從字節出走的陳冕與王長虎而言,字節仍是一道難以忽視的高牆。不過,未來競爭結果尚難預料,AI 影片生成市場仍在擴大,產品尚未進入存量博弈階段,正處於市場擴張的紅利期,留給後進者的空間依然寬廣,一切皆有可能。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。