別人忙著卷Code,Kimi抽身反打瀏覽器插件:網頁操作一秒變Skill

2026年9月25日 14:22
別人忙著卷Code,Kimi抽身反打瀏覽器插件:網頁操作一秒變Skill
站內 AI 整理稿

Kimi你是考古派的啊。。。都6202年了,怎麼還在玩瀏覽器插件???前腳剛出了個Kimi Code Desktop,把瀏覽器加塞進了本地窗口,轉頭又給Chrome安排上了「新」插件。說新吧,倒也沒多新鮮。老瓶裝新酒,就是4個月前發佈的Kimi WebBridge,改頭換面成了Kimi瀏覽器擴展。順便功能也升了級—— 打開網頁、讀取內容、點擊按鈕……這些老一套的東西倒都還在,主要新增功能有兩處: 一是現在瀏覽器側邊欄直接可用,二是在網頁上做過的事能幫忙錄成Skill,方便下次複用。好好好,這下用Kimi更方便了(doge) 新版加點料 老實說,舊版WebBridge的名字還挺直白的。

“網頁橋樑”一頭接本地Agent,一頭連Chrome或Edge擴展。Agent發來指令,它就能在用戶的真實瀏覽器中跳轉頁面並完成任務,再把操作結果送回去。簡而言之,它是讓Agent用上你的瀏覽器。至於新版呢,先是把入口給改了。現在點擊工具欄裡的Kimi圖標,登錄Kimi賬號,就能在側邊欄直接對話,讓Kimi操作當前網頁;原先由本地Agent調用擴展的方式則繼續保留。功能上延續WebBridge,可以完成網頁瀏覽操作與信息抓取。不過,之前Agent通過WebBridge操作瀏覽器時,每次都需要迭代調教一段時間,才能高效完成任務。現在這個問題在新版得到了解決。

新版支持錄製用戶在網頁上的動作,再整理成Skill。舉個栗子,比如我每天都會打開同一個網站,查找當天新聞再導出數據,Kimi瀏覽器擴展現在就能把這一套網頁操作保存成Skill,下次直接調用。如果某次任務做得很順利,Kimi也能將此次會話以Skill形式保存下來。正因如此,新版更適合重複工作。用戶隨手可用,流程也可以反覆調用。當然,官方也提醒,遇到網頁改版、頁面動態加載等情況,仍然可能讓操作中途卡住。所以遇到複雜頁面失敗時,可以先截圖確認頁面狀態,再調整指令。瀏覽器插件仍能打 AI插件走到這兒,其實也繞了挺長一段路。

Manus團隊早年的產品Monica,就把AI放在任意網頁邊上,幫用戶提問、寫郵件;豆包插件也一直在強調視頻內容篩選、外語網頁翻譯和論文閱讀。那一代的AI插件主要解決的是「看網頁」。到了「用網頁」時期,Manus後來又推出了Browser Operator,讓Agent經授權後操作用戶的本地瀏覽器。Kimi WebBridge做的也是差不多的事情,都是真實瀏覽器控制。今天的Kimi瀏覽器擴展則再往前推了一步,能夠讓做過的網頁流程有機會沉澱下來。所以6202年了,瀏覽器插件還真得繼續做,用戶在這兒,痛點也在這兒。

不過,Kimi瀏覽器擴展緊跟著Kimi Code Desktop前後腳發佈,這件事本身就蠻有意思的。Kimi Code Desktop是專門給Agent做項目的工作臺,尤其是內置瀏覽器,會一路跟著項目走,非常適合改完網頁立即看效果。哪裡不對,用戶可以直接點選頁面元素、附上截圖和評論,讓Agent打回重做。

同樣指向瀏覽器,一個是項目內部,一個是用戶外部應用,將Kimi Code Desktop和瀏覽器插件結合來看,產品思路就清楚多了: Agent在桌面端拿到項目文件、終端和改動記錄;需要檢查自己做出的網頁時,打開會話裡的內置瀏覽器;需要進入用戶日常使用的網站時,再通過擴展操作已有的Chrome或Edge。Agent的手越伸越長,也越做越穩。參考鏈接: [1]https://x.com/Kimi_Moonshot/status/2102372557190230244 [2]https://www.kimi.

ai/products/kimi-browser-extension [3]https://mp.weixin.qq.com/s/0x-tXOxlutrxE9YNODng0A — 完 — QbitAI · 頭條號簽約 關注我們,第一時間獲知前沿科技動態 版權所有,未經授權不得以任何形式轉載及使用,違者必究。

Related

相關文章

MarkTechPost AI模型更新

Liquid AI 推出 LFM2.5-VL-3B-DSpark:推測解碼加速視覺語言模型,最高提升 3.13 倍

Liquid AI 發布 LFM2.5-VL-3B-DSpark,這是針對其 LFM2.5-VL-3B 視覺語言模型所設計的實驗性推測解碼草稿模型。該草稿模型約增加 2.8 億個參數,在不改變模型輸出的前提下加快解碼速度。官方數據顯示,在 Apple 晶片上解碼速度最高提升 3.13 倍,在 NVIDIA H100 上則最高提升 2.66 倍。此模型已可部署,權重以 Safetensors 與 GGUF 格式發布於 Hugging Face,並支援 SGLang、MLX-VLM 與 llama.cpp。Liquid AI 團隊將其標註為實驗性版本,採用 LFM 開放授權 v1.0,僅允許年營收低於 1000 萬美元的公司免費商用。推測解碼的原理是:標準模型每次前向傳播僅生成一個 token,而此技術加入一個小型草擬模型,以加速整個生成流程。

3 小時前
IT之家模型更新

德國柏林警方藉助人工智能監控攝像頭打擊犯罪,自動識別暴力和破壞行為

作者:浩渺 責編:浩渺 評論: 9 月 25 日消息,據央視新聞報道,德國柏林警方 24 日在一處犯罪高發區域啟動一項計劃,將藉助人工智能監控攝像頭打擊犯罪。據悉,柏林警方將在這項計劃啟動的前四周內,在科特布斯門地區安裝並調試好人工智能監控攝像頭,隨後正式投入使用。

4 小時前
IT之家模型更新

影石正佈局 AI 眼鏡,或採用“分體電池”設計

首頁 IT圈 最會買 設置 日夜間 隨系統 淺色 深色 主題色 黑色 投稿 訂閱 RSS訂閱 收藏 軟媒應用 App客戶端 要知App 軟媒魔方 業界 手機 電腦 測評 視頻 AI 蘋果 iPhone 鴻蒙 軟件 智車 數碼 學院 遊戲 直播 5G 微軟 Win10 Win11 專題 搜索 首頁 > 智能時代>智能穿戴 影石正佈局 AI 眼鏡,或採用“分體電池”設計 2026/9/25 12:26:17 來源:新浪科技 作者:- 責編:沁滄 評論: 9 月 25 日中午消息,有接近影石創新人士透露,當前影石創新正在佈局 AI 眼鏡賽道,並在進行相關研發,未來或將推出自己的 AI 眼鏡產品。

14 小時前
IT之家模型更新

DeepSeek Harness 官方桌面版預覽偷跑

作者:故淵 責編:故淵 評論: 感謝網友 Domado、陣雨、章魚小丸子、科文雨、億百盧閃蔥、Juliandu、Vincent89、南琴梨 的線索投遞!9 月 25 日消息,DeepSeek Harness 悄然上線官方桌面版,目前還是開發者預覽版,版本號為 V0.

15 小時前
IT之家模型更新

【IT之家開箱】小米 Watch S5 41mm 智能手錶圖賞:瑩白陶瓷表圈 + 24 道精雕錶冠,主打精緻佩戴

作者:馬卡 責編:馬卡 評論: 9 月 25 日消息,在 9 月 23 日晚間舉行的小米秋季新品發佈會上,小米 Watch S5 41mm 智能手錶正式發佈,首發搭載表端澎湃 OS 4,並升級了表端微信 App,售價 1299 元起。小米 Watch S5 41mm 提供氟橡膠錶帶款和真皮錶帶款,售價分別為 1299 元和 1499 元。

16 小時前
MarkTechPost AI模型更新

Black Forest Labs 發布 FLUX 3 Action:70億參數開源權重世界動作模型,躍居 RoboLab-120 榜首

Black Forest Labs(BFL)——FLUX 影像模型背後的實驗室——發布了 FLUX 3 Action。這是一款用於機器人控制的 70 億參數開源權重世界動作模型(WAM)。該模型讀取攝影機畫面、機器人狀態與文字指令,並同時預測未來影片幀與下一段動作。在 RoboLab-120 排行榜上,它以 42.92% 的任務成功率位居第一。它能實際部署嗎?可以,但有條件。DROID 策略在 H200 上以 BF16 格式約需 32 GB GPU 記憶體;若使用 FP8 量化並卸載文字編碼器,則可裝入 24 GB 顯示卡。FLUX Kommunity 授權允許非商業使用。FLUX 3 Action 的取捨:開放式機器人策略通常被迫在兩者間抉擇。如 NVIDIA 的 Cosmos 3 Nano 等 WAM 以 36.8% 居 RoboLab 領先,但預測影片成本高昂;而如 π0.5 等 VLA 則速度較快。

22 小時前