Anthropic 優化 Claude Fable 5 模型生物安全機制,減少 85% 誤攔截

重點摘要
Anthropic 更新 Claude Fable 5 模型的生物安全防護機制,透過調整安全分類器,使系統能更準確區分無害與高風險生物學問題,大幅減少誤攔截。根據官方測試,本次更新讓生物學問答的降級現象減少 85%,模型現在能處理更多生物學任務,但專業生物學研究與藥物開發等請求仍會受到限制。
首頁 > 智能時代>人工智能 Anthropic 優化 Claude Fable 5 模型生物安全機制,減少 85% 誤攔截 2026/8/8 14:50:40 來源:IT之家 作者:潞源 責編:潞源 評論: IT之家 8 月 8 日消息,美國人工智能初創企業 Anthropic 昨日發佈博文稱,公司正在更新 Claude Fable 5 模型的生物安全防護機制,大幅減少誤攔截現象發生。如今 Fable 5 用戶提出生物學相關問題後,系統的降級情況將更少發生。據 Anthropic 官方測試數據,本次更新使生物學相關問答的降級現象減少了 85%,Fable 5 現在可以處理更廣泛的生物學任務。
Anthropic 表示,某些惡意用戶會使用 Fable 5 模型進行生物武器研究等高風險活動。因此公司為了防範這種現象發生,專門為 Claude 設置了安全分類器(safety classifiers),用於檢測用戶是否要求 Fable 5 執行受保護的生物學任務,或者生成有害內容。如今 Anthropic 調整了安全分類器的工作機制,讓它能夠更準確地區分無害問題和高風險問題。不過為了防範持續的 AI 風險,Fable 5 仍會限制專業生物學研究和藥物開發相關請求。
投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:Claude Fable 5,Anthropic,人工智能,生物安全Claude Code v2.1.
224 現支持 AI 跨會話消息傳遞Pro、Max 和 Team 用戶 8 月 14 日起 Claude Code 默認權限調整為自動模式Anthropic 為自研 AI 芯片開出高薪,模型訓練崗位薪資高於實際造芯工程師王興興回應 DeepSeek 投資宇樹:將在三方面開展重點合作Alphabet 再度舉債 200~250 億美元,軟銀以 OpenAI 股份擔保借款 100 億美元美國祖父母熱衷將孫輩寫進 AI 生成童書,引發父母輩大量反感
Related
相關文章

谷歌否認 Gemini 使用私人文檔訓練,此前有開發者稱未公開內容遭洩露
谷歌否認使用私人 Google Docs 文檔訓練 Gemini,回應稱僅在使用者主動請求時才存取 Workspace 文件。開發者發現未公開角色遭洩露,谷歌推測可能原因是公開文檔被搜尋引擎建立索引。事件真實原因仍待進一步調查。

蘋果 Mac 簡體中文支持文檔更新,“Apple 智能”阿里千問擴展現身了
首頁 > Mac之家>Mac新聞 蘋果 Mac 簡體中文支持文檔更新,“Apple 智能”阿里千問擴展現身了 2026/8/8 16:25:11 來源:IT之家 作者:潞源 責編:潞源 評論: 感謝IT之家網友 OurWindows、立立立立立、阿狗、秋釀、蘭花是我 的線索投遞!

奧特曼的ChatGPT育兒大法,捅了馬蜂窩
OpenAI執行長山姆·奧特曼提出結合ChatGPT的育兒方法,引發外界強烈反彈,被形容為「捅了馬蜂窩」。後續反應顯示這項實驗並不順利,凸顯AI在家庭教養領域的應用仍有許多討論空間。

Jeff Dean創業BP曝光,楊植麟也在上面!硅谷VC搶破頭送錢
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> Jeff Dean創業BP曝光,楊植麟也在上面!

OpenAI 下一代 AI 模型 Astra 數學成果遭抄襲指控
OpenAI 推出下一代 AI 模型 Astra,其數學論文遭多位數學家指控抄襲,指稱兩項核心成果未正確引用既有文獻。OpenAI 回應稱對結果正確性負責,並計劃本週對論文進行小幅更新。

小米音箱“超級小愛-專家模式”開啟內測招募:升級聲紋管理、語音歌單等功能
首頁 > 數碼之家>耳機音頻 小米音箱“超級小愛-專家模式”開啟內測招募:升級聲紋管理、語音歌單等功能 2026/8/8 14:54:20 來源:IT之家 作者:歸瀧 責編:歸瀧 評論: 感謝IT之家網友 XRINGO1 的線索投遞! IT之家 8 月 8 日消息,小米音箱“超級小愛-專家模式”現已開啟內測招募。