張一鳴內部發聲:字節模型拒絕“AI蒸餾” 堅持長期主義

2026年8月6日 08:013800 次瀏覽

重點摘要

AI資訊AI新閒資訊正文張一鳴內部發聲:字節模型拒絕“AI蒸餾” 堅持長期主義發布於AI新閒資訊時間 :Aug 6, 2026閱讀 :1分鐘據報道,近日字節跳動創始人張一鳴在近日內部會議上明確強調,大模型研發必須堅持長期主義與延遲滿足感,切忌利用他人模型輸出換取暫時的榜單排名。張一鳴表示,即便在人工智能領域暫時落後於競爭對手,字節Seed團隊也絕不依賴AI蒸餾技術改進自身模型。

站內 AI 整理稿

字節跳動創辦人張一鳴近日在內部會議中明確表態,強調大模型研發必須堅持長期主義與延遲滿足感,切忌利用他人模型輸出換取暫時的榜單排名。他直言,即便在人工智慧領域暫時落後於競爭對手,字節Seed團隊也絕不依賴AI蒸餾技術來改進自身模型。這番談話不僅展現了公司對自主研發的堅定立場,也將AI蒸餾技術的合規爭議再次推向產業焦點。 所謂「AI蒸餾」,是一種透過利用更先進的前沿模型所產出的數據,來訓練自家AI模型的技術手段。這種方法能讓開發者快速提升模型表現,卻也引發了智財權與技術倫理的爭議。過去一段時間,AI巨頭Anthropic曾公開指責多家企業對其模型進行蒸餾,但在其公布的涉事名單中,並未包含字節跳動的Seed系列模型。這也側面印證了字節跳動在內部早已對蒸餾行為設下紅線。 據了解,字節跳動內部已對開源模型實施嚴禁蒸餾的紅線政策,並透過API檢測等技術手段,在內部全面加強合規限制。張一鳴在會議中指出,依賴蒸餾雖然能帶來短期的表現提升,但會嚴重干擾真正意義上的長期技術突破。他強調,團隊必須具備延遲滿足感,不應為了短期的榜單排名而犧牲長期的技術自主性。 隨著全球大模型研發進入深水區,技術源頭創新與合成數據的合規性正成為行業關注的核心焦點。字節跳動此次對蒸餾技術的堅決切割,不僅體現出公司對自主研發與底層技術構建的戰略定力,也預示著大模型競爭正從追求短期性能指標,向錘鍊自主創新能力的長期價值競爭轉變。張一鳴的發言也被內部視為對團隊的一次重要定調,提醒所有研發人員保持技術初心。 在業界看來,AI蒸餾雖然能快速提升模型表現,但長期依賴會讓團隊失去從零開始構建模型的能力,也容易陷入技術抄捷徑的陷阱。字節跳動選擇在這個時候明確表態,無疑是向外界傳遞一個強烈訊號:即使市場競爭激烈,公司依然堅持以原創技術為核心競爭力,而非透過取巧方式追上對手。 值得注意的是,字節跳動的Seed系列模型在業界已有一定知名度,但相較於其他頭部玩家,仍有追趕空間。張一鳴的談話也反映出公司對技術節奏的清醒認知,並不急於在短期內追上所有競爭對手,而是希望透過紮實的研發投入,逐步建立技術壁壘。這種態度在當前AI軍備競賽的氛圍中,顯得格外冷靜。 此外,字節跳動內部對於開源模型的管理也日趨嚴格。除了明確禁止蒸餾行為,公司還透過技術手段監控API使用情況,確保沒有人員或團隊違規使用外部模型輸出進行訓練。這種從制度到技術的雙重防線,展現了公司對合規議題的高度重視,也為其他企業提供了參考。 從更大的產業脈絡來看,AI蒸餾爭議並非孤立事件。隨著大型語言模型成為各國科技巨頭競逐的焦點,如何界定「合理使用」與「不當取用」的界線,已成為法律與倫理層面的重要課題。Anthropic等公司的公開指控,只是冰山一角。字節跳動選擇在此時主動切割,不僅能避免未來可能的法律風險,也有助於塑造公司負責任的技術形象。 張一鳴的內部發聲,也讓外界得以一窺字節跳動在AI領域的戰略思維。長期以來,字節跳動以抖音、TikTok等產品聞名,但在大模型領域,其腳步相較於OpenAI、Google、百度等公司略顯保守。如今,隨著Seed團隊的持續投入,以及張一鳴親自定調,市場對字節跳動在AI領域的未來發展有了更多期待。 當然,拒絕蒸餾並不意味著字節跳動將閉門造車。公司仍然會透過合法合規的方式,獲取必要的訓練數據,並積極參與開源社群的技術交流。張一鳴強調的是「不依賴」而非「不使用」,關鍵在於技術路徑的選擇與自主能力的培養。這種思維,與許多強調「原始創新」的科技領袖不謀而合。 在會議尾聲,張一鳴也鼓勵團隊保持耐心,不要因為短期落後而焦慮。他認為,AI技術的發展是一個長跑,真正的領先來自於持續的底層突破,而非曇花一現的榜單排名。這番話不僅激勵了內部研發人員,也為外界提供了一個觀察字節跳動未來技術走向的重要視角。 總體而言,字節跳動此次對AI蒸餾的明確拒絕,結合張一鳴的內部喊話,標誌著公司在AI大模型競爭中選擇了一條更為艱難但更具長期價值的道路。隨著全球對AI技術源頭創新與數據合規的關注不斷升溫,這家中國科技巨頭的戰略定力,或許將在未來幾年內逐步顯現成效。

Related

相關文章

DeepSeek也扛不住了?API降價後又將大幅漲價

賬號設置我的關注我的收藏申請的項目退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機。

剛剛
IT之家模型更新

華為昇騰宣佈已支持 RL 訓推一致性,實測獲得最高 60% 性能收益

首頁 > 智能時代>人工智能 華為昇騰宣佈已支持 RL 訓推一致性,實測獲得最高 60% 性能收益 2026/8/6 16:13:17 來源:IT之家 作者:汪淼 責編:汪淼 評論: 感謝IT之家網友 不一樣的體驗 的線索投遞! IT之家 8 月 6 日消息,強化學習已成為大模型訓練主流範式,推動模型技術向行業核心場景工程化落地。其中,訓推一致至關重要,因推理與訓練過程耦合,基礎設施差異易放大不確定性。

剛剛
鈦媒體模型更新

Qwen3.8,是千問辦公的“塞爾達”嗎?

阿里旗下通義千問在辦公場景的最新佈局,或許不只是為了賣更多的 API token。近日推出的 Qwen3.8,被內部視為「千問辦公的塞爾達」,這個比喻暗示著它不僅是一個獨立的 AI 模型,更可能承載著開放、可探索、高自由度的產品生態野心。不同於傳統模型單純依賴 token 計費的模式,Qwen3.

剛剛
鈦媒體模型更新

耗時41分鐘,千問辦公押注了怎樣的Agent未來?

千問辦公在生成具身智能行業週報的測試中耗時41分鐘,速度雖慢但強調深度判斷與信源核實,與其他追求效率的AI辦公產品形成對比。文章探討了Token作為AI時代商業語言,以及企業可能推動Agent走向更「重」的未來,以建立用戶信任。三款產品代表不同路線,千問辦公選擇了更注重判斷過程的路徑。

剛剛