何夕2077模型更新

Hark推出瀏覽器智能代理

2026年8月6日 00:00

重點摘要

Hark, a startup that raised $700 million in Series A funding in May, today launched its agent Hark Handoff, which can use a browser efficiently to complete tasks.

站內 AI 整理稿

Hark今日正式推出旗下瀏覽器智能代理服務Hark Handoff,這家新創公司今年五月才完成七億美元的A輪募資,如今端出可實際操作瀏覽器、代用戶完成各種網路任務的AI助理,目標是讓繁雜的線上事務交付給自動化流程處理。根據Hark的說明,Handoff最大的特點在於,即使網站沒有提供官方API,它也能輕鬆應對,包括Target、Walmart、OpenTable與LinkedIn等知名平台都在其列。官方指出,Handoff會同時分析網站的結構與視覺資料,據此判斷目前需要點擊按鈕,還是必須在特定欄位輸入文字。這套運作邏輯與市面上既有的瀏覽器代理工具頗為相似,用戶只要下達指令,代理便會接手執行。

Hark列舉了Handoff能代勞的任務類型,從訂購餐點、買咖啡、訂購旅行票券、線上報稅、採買日常用品,到預訂餐廳座位,甚至代替用戶在各個來源之間穿梭查詢、整理研究資料,都屬於它的工作範圍。換言之,凡是平時得打開瀏覽器逐步操作的事務,理論上都能交由Handoff完成。在Hark對外展示的影片中,執行長Brett Adcock親自示範了Handoff的實戰表現。他要求代理製作一束花,並且具體指定了花材種類,同時還加入「讓花藝師自由發揮」這類較為模糊的條件。Handoff在收到指令後便自行展開瀏覽器操作,設法完成任務。從影片內容來看,它確實展現了一定程度理解自然語言與執行網站操作的能力。

不過,這段展示影片僅呈現了部分執行過程,並非從下指令到完成的全程紀錄,因此外界仍難以從中準確評估Handoff的實際成功率、穩定度以及應對突發狀況的反應能力。對於一個聲稱能取代人工作業的AI代理來說,這些細節反而是最關鍵的考驗。在技術路線方面,Hark透露,這次推出的版本採用的是事後訓練(post-trained)的模型,並計畫在今年稍晚階段進入預訓練(pre-train)階段。公司認為,先以後訓練模型快速累積實戰經驗,能讓團隊更有效率地調整資料管線、訓練基礎架構與相關技術方法,為下一階段的模型開發打下基礎。Hark也對自家模型的設計理念提出說明。

官方聲稱,Handoff與大型語言模型(LLM)不同,LLM的核心任務是預測下一個文字token,而Handoff的模型則是預測「下一個動作」——這個動作可能是在畫面上的特定位置點擊滑鼠,也可能是在某個欄位輸入鍵盤內容。這種以操作為導向的設計,被Hark視為與其他AI代理拉開差距的關鍵。瀏覽器代理已成AI領域競爭激烈的賽道。Google、OpenAI與Anthropic等科技巨頭都在投入電腦操作代理的研發,同時也有不少獲得創投注資的新創公司專注於瀏覽器自動化任務,例如Browser Use、Polar、Strawberry與Aside等,皆試圖在企業與個人用戶的工作流程中卡位。

面對眾多對手,Hark對Handoff的表現頗有信心。公司表示,Handoff在執行速度上優於競品,同時成本也比其他模型更具競爭力,並特別點名與GPT 5.5、Opus 4.8等模型相比,Handoff的運作成本明顯更低。這項成本優勢若屬實,可望成為其吸引用戶採用的重要誘因。目前Hark已經開放平台候補名單,有興趣的用戶可以先行登記,官方則計畫在今年夏天結束前正式對外發布。隨著愈來愈多科技業者投入AI代理戰場,Handoff能否在實際使用中證明自己的效率與可靠性,值得後續觀察。

Related

相關文章

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?

字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

1 小時前

千人聯機世界模型“RhOS-World: Khora”正式發佈

RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。

1 小時前
Hugging Face Blog模型更新

TutorMoments:AI 家教何時該出手,何時該放手?

今日我們推出 TutorMoments 預覽版,這是一個評估框架,旨在衡量尖端大型語言模型能否掌握教育中最難的平衡:何時介入協助學生,何時退後讓學生自行努力。TutorMoments 基於真實的一對一數學輔導課程,透過重播方式進行評估。經驗豐富的數學教師會檢視從美國收集的對話記錄。

2 小時前