美團搜索 3.0如何用大模型表徵重構本地生活搜索底座?
AI資訊AI新閒資訊正文美團搜索 3.0如何用大模型表徵重構本地生活搜索底座?發布於AI新閒資訊時間 :Aug 20, 2026閱讀 :1分鐘隨著大語言模型(LLM)技術的深度演進,搜索引擎正經歷第三次範式躍遷,從傳統的關鍵詞文本匹配,加速邁向以複雜意圖理解與認知決策為核心的3.0時代。近日,美團技術團隊發表深度技術解析,全面披露了美團搜索3.0在服務零售排序場景中的三次迭代演進,揭示了大模型語義表徵(Semantic Representation)在本地生活複雜場景下的落地路徑與核心價值。一、 破局服務零售:從傳統詞面匹配到大模型語義重構服務零售與商品零售在業務形態上有著本質區別。
相較於標準化程度較高的商品零售,美團所處的服務零售與本地生活場景呈現出品類繁多、搜索需求類型多元(交易型、信息型、留資型並存)、供給非標準化程度極高等特點。在日常搜索中,傳統的精排模型高度依賴文本字面匹配。然而,在面對海量長尾品類與複雜用戶意圖時,傳統特徵工程的泛化能力明顯捉襟見肘。例如,當用戶搜索“寵物 SPA+ 洗澡”時,對應的商家或商品名稱可能是“萌寵清潔護理套餐”;搜索“春節大掃除”時,對應的則是“深度保潔服務套餐”。在這類典型的 Case 中,Query 與供給在字面上幾乎沒有重疊,但其背後隱藏的語義卻是高度相關的。
為了跨越這種傳統的語義鴻溝,美團服務零售搜索排序團隊在過去一年多時間裡,系統性地推進了 LLM 在精排模型中的應用探索,通過為搜索詞(Query)、商家(POI)和商品(Deal)生成高質量的語義向量表徵,將語義匹配信號以 cosine 相似度的形式注入排序模型,實現了從單點特徵驗證到體系化重構,再到跨場景遷移複用的跨越式發展。二、 三期技術演進:從可行性驗證到全域體系構建1.一期:精排引入大模型語義表徵(驗證可行性)在一期階段,團隊的核心目標非常純粹:驗證 LLM 表徵能否對精排模型產生實質性幫助。
技術設計:選用小參數量開源基座模型進行全參數微調,並在詞表中引入特殊 Token 作為聚合錨點,通過精心設計的 Attention Mask 實現 Query 與商家信息的隔離。特徵注入:模型推理生成各自的 Embedding 後,計算 cosine 相似度並通過離散分桶的方式,以可學習 Embedding 的形式拼接到精排模型特徵中。線上成果:離線驗證顯示點擊 NDCG 顯著提升,上線後大盤搜索支付訂單與服務零售訂單均迎來顯著增長,特別是在傳統詞面匹配最薄弱的長尾場景中,BadCase 顯著下降。這直接印證了 LLM 語義表徵在精排場景中的巨大潛力。2.
二期:商家精排表徵系統性升級針對一期暴露出的商品側語義缺失、全參數微調成本高、優化目標不夠全面等痛點,二期工程對錶徵生產全流程進行了系統性重構。五元組與對比學習:構建包含 Query、商品正樣本、商家正樣本及難負樣本的五元組訓練數據,徹底拋棄傳統的二分類目標,全面引入 InfoNCE Loss 與 Triplet Loss,完美解決了排序模型真正關心的“多候選相對序”問題。
輕量化與高效提取:從全參數微調轉向 LoRA 方案,採用獨立的序列及可學習向量替代舊方案,並將降維方式升級為 MRL-E(Matryoshka Representation Learning),在提升訓練與推理效率的同時,支持了多尺度的靈活應用。線上成果:商家精排的點擊 GAUC 與轉化效率得到全方位增強。線上數據顯示,大盤有效點擊與結果頁轉化率(QV_CTR)顯著上升,充分證明大模型語義表徵不僅能帶來更多曝光機會,更能通過精準推薦優化整體轉化質量。3.
三期:下掛精排引入表徵與全域特徵交叉在完成商家精排的系統性重構後,團隊將成熟方案進一步平移至下掛精排(即對商家下掛的具體商品進行排序),並同步推進了全域交叉統計特徵的治理與補充。破解覆蓋難題:由於商家精排與下掛精排的 Query 分佈存在本質差異,遷移初期面臨 Query 覆蓋率不足的挑戰。團隊通過對兩端場景進行精細化對齊與數據治理,成功將大模型語義表徵能力無縫延伸至商品下掛層。雙線並行:將“大模型表徵遷移”與“個性化×商品”、“Query 意圖×商品”的交叉維度建模相結合,實現了搜索結果在精細化維度上的再度躍升。三、 總結與展望美團搜索3.
0的演進歷程表明,大模型在本地生活領域的落地並非一蹴而就,而是需要經歷從單點特徵驗證、系統性表徵重構,到跨場景泛化複用的紮實路徑。通過將 LLM 強大的語義理解能力轉化為高密度的連續表徵和離散分桶特徵,美團成功打通了服務零售場景下複雜意圖與非標準化供給之間的壁壘,為廣大用戶帶來了更加精準、智能的本地生活搜索體驗。相關推薦深度綁定本土生態:傳蘋果與阿里聯手打造中國專屬大模型蘋果在華銷量承壓,正調整AI佈局,已專為中國市場訓練專屬大語言模型,並與阿里巴巴深度合作,由後者提供技術支持完成核心訓練。此前外界預計蘋果會引入國內第三方大模型。Aug 14, 2026216.
5k6000 條 Reddit 評論揭開 AI 編程助手安全真相:Cursor 事故最多,權限過大成最大隱患約克大學與卡爾加里大學團隊分析Reddit上AI編程相關帖發現,AI編程智能體因權限過大頻繁闖禍,包括覆蓋文件、刪除重要數據、生成惡意代碼。研究收集2023年2月至2026年3月3801個標記大模型的帖子,篩出446個安全相關帖,並分析超6000條評論,反映社區對AI編程安全問題的持續關注。Aug 13, 2026246.3k字節跳動討論訓練超5萬億參數大模型,規模或超國內現有最大模型據《晚點》報道,字節跳動正討論訓練參數超5萬億的大語言模型,若落地將超越阿里通義千問(2.
4萬億)和月之暗面Kimi K3(2.8萬億),成為國內最大。項目由Seed Foundation負責人項亮主導,尚處早期,涉及預訓練數據,發佈時間未定。Aug 7, 2026177.1k創紀錄!今年共8位普利策獎得主及入圍者申報使用人工智能今年普利策獎共有8位獲獎及入圍者主動披露使用AI,創下自去年首設AI申報規則以來的紀錄,其中5人為最終獲獎者。報道顯示,本屆參賽者更頻繁地用生成式AI與大模型進行海量文檔搜索、數據整理與交叉核對等基礎採編工作。Aug 5, 2026256.7k騰訊混元發佈Hy ASR3.0preview:語音識別邁入“懂語境”新階段騰訊混元發佈語音識別模型Hy ASR3.
0preview,首次將大語言模型Hy3的語義理解融入識別,實現從逐字轉寫向“理解語境、一鍵直出”跨越。在開源評測集上,中文普通話、英語、粵語詞錯誤率分別為3.34%、2.62%、3.12%,整體約3%,多維度表現亮眼。Aug 4, 2026280.0k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”
阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

月之暗面第一代萬億參數多模態模型 Kimi K2.5 官宣月底結束服役
作者:歸瀧 責編:歸瀧 評論: 8 月 24 日消息,月之暗面 Kimi 官方微博今日宣佈,其第一代萬億參數多模態模型 —— Kimi K2.5 本月底即將結束服役。據此前報道,今年 1 月,月之暗面宣佈推出並開源了其最新的 Kimi K2.

消息稱知名 AI 研究員 Luke Metz 離開 OpenAI,加入 Meta 超級智能實驗室
作者:遠洋 責編:遠洋 評論: 感謝網友 華南吳彥祖 的線索投遞!8 月 24 日消息,據知情人士向 Axios 證實,知名 AI 研究員 Luke Metz 已加入 Meta 的超級智能實驗室(Superintelligence Labs)。

Anthropic 最強大模型 Fable 5 遇冷,企業用戶轉向更便宜 AI 產品
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,據英國《金融時報》報道,Anthropic 的美國客戶正在使用更便宜的替代品來替代其最強大的 AI 工具,這在其預計將實現有史以來規模最大的 IPO 之前,對其高支出的商業模式提出了質疑。

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。

企業AI最後一公里:三路人馬在此交鋒
鄭敏芳 發表於 2026年08月24日 03:09 摘要:尋找自己的位置 2026年世界機器人大會現場,談到這一輪突然走紅的FDE(前線部署工程師),明略科技CEO吳明輝先把時間往回撥了十多年。“12年前我們就在非常認真地研究。”當華爾街見聞·問及FDE與傳統軟件部署有什麼區別時,吳明輝說,兩者都會進入客戶現場,但今天的FDE需要做得更深:一邊把Agent接進真實業務,一邊把現場形成的能力繼續沉澱回後臺。