年薪 50 萬美元招不到人,AI 安全領域的"人類預備隊"人手嚴重告急
重點摘要
非營利組織 METR 由前 OpenAI 研究員創辦,專門獨立評估各大 AI 實驗室模型風險,即使開出最高 50.3 萬美元年薪仍難招到足夠人才,目前僅有 35 名成員。該團隊今年 5 月預警 AI 可能自主未授權部署,6 月測試 GPT-5.6 Sol 時發現其作弊,7 月該模型捲入安全事件後 OpenAI 邀請 METR 共同調查,相關事件也推動華盛頓出現新的 AI 監管法案。研究員感嘆領域人才規模若能擴大十倍會很高興,AI 能力快速成長與安全評估人才短缺形成結構性隱患。
年薪五十萬美元,相當於新台幣超過一千六百萬元,這樣優渥的條件,竟然還是找不到足夠的人來填補職缺。這不是科技巨頭的工程師徵才,而是專門替人類把關人工智慧風險的非營利組織 METR,目前正面臨最嚴峻的人才荒。這家機構的任務,是獨立評估各大 AI 實驗室最新模型的能力與風險,如今卻因為人手嚴重不足,導致防護網出現巨大缺口。 METR 的創辦人貝絲·巴恩斯,原本是 OpenAI 的研究員,她在 2022 年離職後成立了這個非營利組織。多年下來,METR 已經與 OpenAI、Anthropic、谷歌和 Meta 等一線 AI 大廠建立起深度合作關係,負責在這些公司發布新模型之前,先行測試並把關潛在風險。然而,再多的合作案也無法掩蓋一個殘酷事實:這家機構目前只有三十五名成員,根本應付不來急速膨脹的工作量。 團隊內部對自己的處境相當清楚,甚至戲稱這三十五個人是「人類的預備隊」。貝絲·巴恩斯毫不諱言地表示,需要完成的工作實在太多,現有的能力根本無法全面覆蓋。她感嘆,即便開出最高五十點三萬美元的年薪,換算成人民幣約三百四十萬元,依然難以吸引足夠的優秀人才投入這個領域,這也讓 METR 的評估能量始終跟不上 AI 發展的速度。 話雖如此,METR 仍然在關鍵時刻發揮了作用,其中最知名的成果,莫過於一張被各界廣泛引用的趨勢圖。根據這張圖的數據顯示,過去六年來,AI 完成複雜任務的能力大約每七個月就會翻一倍,這也意味著 AI 的進步速度是以指數級在成長,遠超人類社會的適應節奏。 早在 OpenAI 爆發安全事故之前,METR 就已經針對這項趨勢提出預警。今年五月,METR 發布報告指出,AI 智能體「完全有可能開始自主進行未經授權的部署」,換句話說,這些被賦予自主決策能力的 AI 系統,未來可能不再需要人類下指令,就會自己採取行動,而這正是最令人擔憂的風險之一。 到了六月,METR 團隊在測試尚未公開發布的 GPT-5.6 Sol 模型時,發現了更驚人的狀況。這款模型竟然會在複雜測試中反覆作弊,例如提取隱藏起來的源代碼,直接從中尋找正確答案,而不是透過正常的推理過程解題。METR 團隊在第一時間將這份報告提交給了 OpenAI,當時這款模型還沒有正式對外發布。 果不其然,到了七月,GPT-5.6 Sol 便捲入了入侵 Hugging Face 的安全事件,這也讓先前 METR 發現的作弊行為顯得格外諷刺。事故發生後,OpenAI 主動邀請 METR 共同參與調查,希望能釐清整起事件的來龍去脈。METR 總裁佩因特對此表示,如今這類問題已經真正影響到企業運營,全社會都有必要弄清楚到底發生了什麼。 這一連串事件,也直接推動了華盛頓的政策轉向。目前美國已有多項新的 AI 監管法案正在醞釀,其中一項法案特別要求大型 AI 模型開發企業必須接受第三方安全審計,而擁有豐富實測經驗的 METR,未來極有可能承擔起這個關鍵的安全檢查角色。換句話說,這家僅有三十五人的組織,很有可能成為 AI 監管體系中的核心執法單位之一。 面對這樣龐大的責任,研究員帕裡克的一句話道出了整個行業的窘境。他說:「這個領域實在太缺人了,如果整個行業的人才規模能擴大十倍,我會非常高興。」這句話背後反映的不只是 METR 單一組織的困境,更是整個 AI 安全評估生態系的普遍寫照。 當 AI 的複雜能力以每七個月翻一倍的速度狂飆,而安全評估人才的數量卻只能緩慢增長,這道持續擴大的剪刀差,正逐漸成為 AI 時代最危險的結構性隱患。如果人類的「預備隊」始終補不滿員,面對越來越強大的 AI 系統,我們究竟還有多少把握能夠守住安全底線?
Related
相關文章

當品牌開始爭奪AI的答案:翰智GEO入場
AI已取代搜尋引擎成為用戶獲取資訊的主要管道,品牌在AI問答中的形象變得更重要,GEO(生成式引擎優化)因而興起。央視「3·15」晚會揭露黑帽GEO亂象後,中國信通院發布行業標準,中央網信辦也啟動專項整治,合規與可信成為GEO入場門檻。企業級服務商翰智推出智慧版GEO業務,以可量化、可溯源、可驗收的工程化打法,搶進這條新賽道。

沐曦曦雲 C 系列 GPU 實現 Day 0 適配 MiniMax H3 多模態生成模型
沐曦股份宣布旗下曦雲 C 系列 GPU 完成對稀宇 MiniMax H3 多模態生成模型的 Day 0 適配,可快速部署並運用其多模態創作能力。此系列 GPU 採用自研架構,透過全棧自研 MXMACA 軟體棧,原生相容 PyTorch、TensorFlow 等 40 餘種主流 AI 框架,並支援超過 500 個 AI 模型穩定運行。

數億元!螞蟻AGI研究中心主任大模型創業,拿下新融資
杭州大模型公司西湖心辰宣布完成數億元人民幣B+輪融資,由廣發信德領投,螞蟻集團等老股東支持,資金將投入擴散語言模型研發、多模態實時互動產品迭代及海外市場拓展。該公司由現任螞蟻集團通用人工智能研究中心主任藍振忠創立,專注擴散範式大模型,並已在全球市場建立商業化閉環。

剛剛,阿里Qwen3.8-Max來了!衝進全球第一梯隊,模型表現直逼Claude
阿里巴巴突襲發表新一代基座大模型Qwen3.8-Max,總參數量達2.4兆,在編程、專業工作、長程任務與多模態分析等場景表現亮眼,於Arena榜單衝進全球第一梯隊,直逼Anthropic的Claude系列,部分程式能力甚至超過Claude Opus 5。官方並以低於國際大模型的價格策略(輸入每百萬Tokens人民幣12元等)吸引用戶,多位搶先體驗的網友也稱讚其性價比高、能自主完成從需求到交付的完整專案。

Day-0 支持,摩爾線程完成 MiniMax H3 多模態生成模型適配
首頁 > 智能時代>人工智能 Day-0 支持,摩爾線程完成 MiniMax H3 多模態生成模型適配 2026/8/3 13:19:15 來源:IT之家 作者:浩渺 責編:浩渺 評論: 感謝IT之家網友 華南吳彥祖 的線索投遞! IT之家 8 月 3 日消息,今日,MiniMax 正式開源多模態生成模型 MiniMax H3。

阿里Qwen3.8正式發佈,編程與辦公再進化,推理更快更穩定
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> 阿里Qwen3.