Anthropic 優化 Claude Fable 5 模型生物安全機制,減少 85% 誤攔截

重點摘要
Anthropic 更新 Claude Fable 5 模型的生物安全防護機制,透過調整安全分類器,使系統能更準確區分無害與高風險生物學問題,大幅減少誤攔截。根據官方測試,本次更新讓生物學問答的降級現象減少 85%,模型現在能處理更多生物學任務,但專業生物學研究與藥物開發等請求仍會受到限制。
首頁 > 智能時代>人工智能 Anthropic 優化 Claude Fable 5 模型生物安全機制,減少 85% 誤攔截 2026/8/8 14:50:40 來源:IT之家 作者:潞源 責編:潞源 評論: IT之家 8 月 8 日消息,美國人工智能初創企業 Anthropic 昨日發佈博文稱,公司正在更新 Claude Fable 5 模型的生物安全防護機制,大幅減少誤攔截現象發生。如今 Fable 5 用戶提出生物學相關問題後,系統的降級情況將更少發生。據 Anthropic 官方測試數據,本次更新使生物學相關問答的降級現象減少了 85%,Fable 5 現在可以處理更廣泛的生物學任務。
Anthropic 表示,某些惡意用戶會使用 Fable 5 模型進行生物武器研究等高風險活動。因此公司為了防範這種現象發生,專門為 Claude 設置了安全分類器(safety classifiers),用於檢測用戶是否要求 Fable 5 執行受保護的生物學任務,或者生成有害內容。如今 Anthropic 調整了安全分類器的工作機制,讓它能夠更準確地區分無害問題和高風險問題。不過為了防範持續的 AI 風險,Fable 5 仍會限制專業生物學研究和藥物開發相關請求。
投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:Claude Fable 5,Anthropic,人工智能,生物安全Claude Code v2.1.
224 現支持 AI 跨會話消息傳遞Pro、Max 和 Team 用戶 8 月 14 日起 Claude Code 默認權限調整為自動模式Anthropic 為自研 AI 芯片開出高薪,模型訓練崗位薪資高於實際造芯工程師王興興回應 DeepSeek 投資宇樹:將在三方面開展重點合作Alphabet 再度舉債 200~250 億美元,軟銀以 OpenAI 股份擔保借款 100 億美元美國祖父母熱衷將孫輩寫進 AI 生成童書,引發父母輩大量反感
Related
相關文章

Jeff Dean創業BP曝光,楊植麟也在上面!硅谷VC搶破頭送錢
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> Jeff Dean創業BP曝光,楊植麟也在上面!

OpenAI 下一代 AI 模型 Astra 數學成果遭抄襲指控
OpenAI 推出下一代 AI 模型 Astra,其數學論文遭多位數學家指控抄襲,指稱兩項核心成果未正確引用既有文獻。OpenAI 回應稱對結果正確性負責,並計劃本週對論文進行小幅更新。

小米音箱“超級小愛-專家模式”開啟內測招募:升級聲紋管理、語音歌單等功能
首頁 > 數碼之家>耳機音頻 小米音箱“超級小愛-專家模式”開啟內測招募:升級聲紋管理、語音歌單等功能 2026/8/8 14:54:20 來源:IT之家 作者:歸瀧 責編:歸瀧 評論: 感謝IT之家網友 XRINGO1 的線索投遞! IT之家 8 月 8 日消息,小米音箱“超級小愛-專家模式”現已開啟內測招募。

全球第二:馬斯克 SpaceXAI 推出 Imagine Image 2.0,強化 AI 生圖 / 編輯能力
SpaceXAI推出Imagine Image 2.0模型,強化AI生圖與編輯功能,新增魔棒、分割、背景移除等工具。該模型在文生圖與圖像編輯排行榜上均排名全球第二,僅次於OpenAI的GPT Image 2。

Claude Code v2.1.224 現支持 AI 跨會話消息傳遞
Anthropic 宣布 Claude Code v2.1.224 版本開始支援跨會話訊息傳遞,讓不同會話之間能互相發送更新與警告。此功能適用於移交調查結果、協調並行工作樹、取得長時間運行狀態等場景,有助於用戶在多個會話中協同處理專案。
