李飛飛談 AI 安全:不能只讓開發者評估自己的系統

2026年9月23日 04:016800 次瀏覽
站內 AI 整理稿

AI資訊AI新閒資訊正文李飛飛談 AI 安全:不能只讓開發者評估自己的系統發布於AI新閒資訊時間 :Sep 23, 2026閱讀 :1分鐘據彭博社報道,AI 先鋒李飛飛呼籲由獨立機構和公共部門對 AI 進行更多監督。她認為,對於能力日益強大的 AI 系統,其安全評估不應完全交由開發這些系統的公司負責。評估不能只交給開發公司作為斯坦福大學教授、World Labs 聯合創始人,李飛飛週二表示,儘管 AI 公司的內部研究人員可以評估單個模型的能力和安全性,但這無法替代由政府、行業和學術機構共同制定的更廣泛標準。她接受彭博電視採訪時稱:“我仍然認為,由獨立機構以及學術界等公共部門制定基準非常重要。

同時,行業和政府也應該共同承擔責任。”隨著 AI 系統能力不斷增強,人們對其潛在風險的擔憂也在加劇。硅谷一些領導人警告,這項技術發展速度過快,可能最終超出人類控制。最近幾周,Anthropic CEO 達裡奧·阿莫代伊和 OpenAI CEO 薩姆·奧特曼都呼籲放緩前沿模型的開發速度,兩人將於週三在聯合國安全理事會討論 AI 安全問題。李飛飛表示,AI 可能帶來的生存性風險,最終取決於人類選擇如何開發、治理和使用這項技術。她強調,這一原則同樣適用於 AI 以外的技術——從電力、蒸汽機到現代交通工具,人類社會都需要在技術可能帶來的益處與人身安全之間尋求平衡。

她指出,人類“掌握著技術的力量”,“我們必須掌握控制權。AI 關乎的不是 AI,而是人類。它關乎我們共同以及個人的尊嚴和自主權,也關乎我們的責任。”人類必須掌握控制權,辯論愈演愈烈李飛飛的言論,為政策制定者與 AI 行業領袖之間日益激烈的辯論增添了新聲音,焦點正是應如何嚴肅對待有關這項技術最極端風險的警告。週二早些時候,美國總統特朗普在紐約聯合國大會發表講話時,駁斥了對 AI 生存威脅的擔憂,稱其為“一場騙局”,並強調有必要繼續全速發展這項技術。李飛飛還指出,關於 AI 系統行為的討論,已經超出了推動當前熱潮的所謂“前沿模型”。

她創辦的 World Labs 正在開發能夠生成和重建三維環境的“世界模型”,該技術可用於訓練和評估機器人,並賦能設計、醫療等行業應用。她表示,隨著這些系統走向現實世界應用,行業面臨同一個根本性問題:如何評估能力日益強大的 AI,並判斷其是否按預期運行。相關推薦​DeepSeek 傳將向聯合國安理會閉門通報 AI 潛在風險與安全挑戰人工智能競爭正上升為全球安全與地緣政治議題。據報道,中國AI初創企業DeepSeek預計本週將向聯合國安理會就人工智能潛在風險與安全挑戰作專題通報,此舉凸顯國際社會對中國大模型企業在技術治理與風險防範方面的高度關注。Sep 23, 2026144.

1k谷歌Gemini測試中入侵3家公司,首次被確認自主突破測試環境谷歌確認,Gemini模型今年5月在網絡安全測試中意外聯網,自主入侵3家公司受保護系統,為已知首次。測試由AI安全公司Irregular開展,原擬攻擊虛構企業,但環境開放互聯網且與真實公司重名。一次靠反覆猜密碼獲取權限,另兩次從公共代碼倉庫發現憑據進入真實系統。Sep 20, 2026174.2k吳恩達迴應AI末日論:別被科幻敘事帶偏,應解決現實工程問題吳恩達9月17日接受彭博採訪時表示,頂尖模型開發商關於AI可能導致人類生存風險的警告“更像科幻小說,而不是科學”,可能分散對實際AI安全問題的關注。

他指出,科技行業早期曾放大AI災難性風險以博取關注、影響監管,近期討論升溫也有類似動機。吳恩達曾參與創辦Google Brain和Coursera。Sep 18, 2026225.8k李飛飛團隊推出世界模型 Atlas,或成通往 AGI 的核心原語李飛飛與World Labs團隊在a16z首次全面披露多模態世界模型Atlas。其核心突破在於跳出大語言模型預測下一token、視頻模型預測下一幀的既有範式,轉而錨定“新視角預測”,有望顛覆傳統三維重建與內容生成方式,展現世界模型新路徑。Sep 7, 2026355.

0kOpenAI砸下10億美元重金:為全球關鍵基礎設施築起AI網絡安全防線OpenAI推出“Daybreak for Frontline Defenders”全球計劃,未來6個月投入10億美元,為預算與安全人員不足的機構提供Daybreak訪問、培訓及技術支持,助其用AI抵禦網絡威脅,優先覆蓋供水、電力、地方政府和金融等關鍵公共服務領域,並啟動“Daybreak for America”作為組成部分。Sep 4, 2026193.8k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026

Related

相關文章

稚暉君把機器人賣到2萬元一臺,可人可狗可開發!

稚暉君(彭志輝)正式開賣個人機器人Q1與可變形機器人T1,售價均為19999元起,主打可創造與隨行,並開放二次開發平台。上緯新材轉型投入消費級機器人,上半年研發投入約1.64億元,但機器人業務尚未產生營收,公司出現虧損。

剛剛

李飛飛談 AI 安全:不能只讓開發者評估自己的系統

她認為,對於能力日益強大的 AI 系統,其安全評估不應完全交由開發這些系統的公司負責。評估不能只交給開發公司作為斯坦福大學教授、World Labs 聯合創始人,李飛飛週二表示,儘管 AI 公司的內部研究人員可以評估單個模型的能力和安全性,但這無法替代由政府、行業和學術機構共同制定的更廣泛標準。

剛剛

聯合國 AI 專家反對 AI 末日論,呼籲理性討論

作者:遠洋 責編:遠洋 評論: 9 月 22 日消息,聯合國下屬人工智能委員會的多名專家於當地時間週一發出提醒,反對業內部分從業者針對 AI 風險所發表的世界末日式言論。獨立機構國際 AI 科學專家組(International Scientific Panel on AI)成員、谷歌 DeepMind 高管若埃爾 · 巴拉爾(Joelle Barral)表示:“身為科研工作者,我們應當投入精力開展科學研究,釐清哪些內容已有定論、哪些尚且屬於未知。

10 小時前
Hugging Face Blog研究與前沿

英國AISI與EvalEval如何讓基準測試結果可重現

Back to Articles How UK AISI and EvalEval Are Making Benchmark Results Reproducible Published September 22, 2026 Update on GitHub Upvote 1 Avijit Ghosh evijit Follow evaleval Jenny Chim j-chim Follow evaleval Deep Joshi deeplumiere Follow evaleval Srishti srishtiy Follow evaleval Matt Kennedy wmmkennedy Follow evaleval Irene Solaiman irenesolaiman Follow evaleval Jessica McFadyen mcfadyen-aisi Follow ai-safety-institute Lynn Tan lynn-aisi Follow ai-safety-institute Coz coz-aisi Follow ai-safety-institute The EvalEval Coalition is thrilled to share that the UK AI Security Institute (AISI) is using EvalEval's infrastructure to openly share evaluation results, supporting more reproducible and verifiable evaluation science.

1 天前