Inherent 推出小參數 AI 智能體 Faraday,科研復現能力超越 GPT‑5.5 與 Claude Opus 4.8

2026年8月23日 08:15
Inherent 推出小參數 AI 智能體 Faraday,科研復現能力超越 GPT‑5.5 與 Claude Opus 4.8
站內 AI 整理稿

作者:遠洋 責編:遠洋 評論: 8 月 23 日消息,總部位於倫敦的 AI 實驗室 Inherent 由前谷歌 DeepMind 員工創立。該公司表示,其 AI 智能體 Faraday 僅使用規模遠小於 Anthropic 和 OpenAI 旗艦模型的模型,就在一項特定任務中取得了更好的表現。在眾多由前 Google DeepMind 員工創辦的初創公司中,Inherent 此前獲得的關注相對較少。不過,與那些資金更加充裕、卻還沒有拿出太多實際成果的競爭對手相比,這家總部位於倫敦的團隊如今已經開始展示自己的研發成果。這家英國初創公司僅在以 5,000 萬美元(注:現匯率約合 3.

37 億元人民幣)種子輪融資走出隱身模式幾周後,就宣佈推出新的 AI 智能體 Faraday。該公司表示,在一項特定任務中,Faraday 擊敗了規模更大、知名度更高的 AI 模型:在事先不知道答案的情況下,自主復現已發表科學論文中的研究結果。如果考慮到 Inherent 更宏大的目標 —— 打造能夠發現全新科學知識,而不僅僅是驗證已有研究成果的 AI,那麼復現論文的能力聽起來似乎只是一個“小把戲”。但 Inherent 聯合創始人兼首席科學家 Edward Hughes 表示,論文復現本身也是人類科學家的標準訓練方式。“很多博士生實際上都是從這件事開始的。

”Hughes 告訴 TechCrunch,擊敗其他 AI 系統並不是重點,真正重要的是 Inherent 如何做到這一點。他說:“對我們來說,最有意思的並不是擊敗那些前沿智能體的結果 —— 當然,我們對此也很高興,而是我們構建這個系統的方式。”真正值得投資者關注的是,Faraday 在與 Anthropic 的 Claude Opus 4.8 和 OpenAI 的 GPT-5.5 進行比較時,所依賴的卻是一個規模小得多的模型 Qwen 3.6,僅擁有 270 億參數。這兩個對手都是規模龐大的前沿 AI 系統。簡單來說,“參數”可以作為衡量模型規模的一個指標,通常也與模型的訓練成本有關。

此外,Inherent 對 Faraday 的成功標準也並不只是準確率。除了復現科學研究結果之外,公司還希望 Faraday 展現出所謂的“研究品味”,也就是能夠判斷哪些實驗值得進行,以及應該如何合理設計這些實驗的能力。教會 AI 掌握這種難以量化的“品味”並不容易,這也是強化學習發揮作用的地方。強化學習是一種訓練 AI 的方法,它並不是把一套明確的規則直接告訴 AI,而是根據最終結果對 AI 的行為進行獎勵,從而讓系統逐漸學會採取更有效的行動。相比主要通過學習科學研究本身的流程來訓練智能體,Inherent 更依賴這種基於獎勵的訓練方式。

公司希望這種方法能夠更好地泛化到長期目標,即讓 AI 智能體具備參與多個科學領域研究工作的能力。Hughes 表示:“我們始終以打造 AI 科學家智能體、賦予智能體研究品味這一北極星目標為指導。”這一理念也影響了 Inherent 決定不開發哪些產品。例如,公司沒有選擇自行開發編程工具,而是讓 Faraday 使用 OpenAI 的 GPT-5.5 Codex。這與人類科學家的工作方式類似 —— 科學家通常會利用現成的軟件工具,而不是把所有工具都從頭開發一遍。Inherent 還試圖避免打造那些只會迎合用戶、告訴用戶想聽什麼的 AI 智能體。

Hughes 表示,公司希望打造的智能體更像他最喜歡的那類隊友:他們會回來告訴你:“我對這個問題產生了興趣,於是自己去做了這些實驗。你覺得這些結果怎麼樣?”這種協作理念同樣體現在 Inherent 的公司運營方式上。目前公司約有 12 名員工,全部在倫敦國王十字區的一間辦公室裡線下辦公。國王十字區曾經是一個較為破敗的倫敦街區,但隨著 Google DeepMind 在當地的發展,如今已經成為全球最重要的 AI 創新中心之一。Hughes 表示:“我們相信,倫敦就是最適合發展的地方。

”Hughes 對倫敦高度密集的 AI 人才資源非常看好,但與此同時,他也加入了要求英國取消“競業休假”(garden leave)制度的呼聲。所謂“競業休假”,是英國職場中較為常見的一種做法。員工離職後,公司可以要求他們在數個月內不得加入競爭對手或創辦競爭企業。美國研究人員通常不會受到類似限制,這也讓美國初創公司在招聘那些剛剛離開上一份工作的 AI 人才時擁有一定的先發優勢。Hughes 告訴 TechCrunch:“這是我個人的看法,並不代表公司的立場,但我確實受到過競業休假的影響。

”最終,Hughes 找到了繞開這一限制的方法,並與另外兩名前 DeepMind 員工以及第四位聯合創始人共同創辦了 Inherent。而這家初創公司目前也沒有放緩發展的跡象。Inherent 計劃在今年年底前將員工人數擴大至“大約 20 至 25 人”。考慮到公司同樣在佈局世界模型,再加上 Demis Hassabis 出任新職後,一些 DeepMind 員工的未來去向出現不確定性,Inherent 正在進行的大規模招聘,或許會讓它成為考慮離開 DeepMind 的員工頗具吸引力的新去處。

投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:Inherent,DeepMind,Faraday,AI智能體揭秘 OpenAI 的“終極野心”:讓智能體像人類一樣熟練操作電腦哈佛大學和麻省理工造出 83 億個“AI 人”,模擬全球人類行為消息稱谷歌 DeepMind 團隊不再追逐前沿模型研發工作,或迎大規模裁員谷歌 DeepMind 換帥內情:Gemini 延期兩月後編程能力仍落後友商,布林親自督戰並要求“全力投入”Y Combinator CEO 陳嘉興:善用 AI 智能體的創業者將提前活在 2028 年6000+ 條評論 AI 編程智能體真實安全事故洞察:Cursor 問題最多

Related

相關文章

量子位生成式AI

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”

阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

剛剛
IT之家生成式AI

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入

作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。

剛剛