支持澳大利亞青少年社交媒體禁令的報告存在多處引用錯誤,機構承認使用了 ChatGPT 編輯

2026年8月17日 11:48
支持澳大利亞青少年社交媒體禁令的報告存在多處引用錯誤,機構承認使用了 ChatGPT 編輯
站內 AI 整理稿

作者:遠洋 責編:遠洋 評論: 8 月 17 日消息,據《衛報》報道,負責測試澳大利亞社交媒體禁令背後相關技術的一份報告,其作者承認在編輯過程中使用了 ChatGPT,但否認報告中的多處引用錯誤是由人工智能“幻覺”造成的。這項耗資 348 萬澳元(注:現匯率約合 1,662.9 萬元人民幣)的年齡驗證技術測試由總部位於英國的 Age Check Certification Scheme(ACCS)於去年開展,主要測試各種可能被社交媒體平臺用於落實澳大利亞未滿 16 歲用戶社交媒體禁令的技術。

澳大利亞通信部長 Anika Wells 曾高度評價這份報告,稱其展示了“許多有效的選擇”,併為去年 12 月社交媒體禁令正式生效鋪平了道路。報告大部分內容來自作者對目前可用的各種年齡驗證技術進行的實際測試,但其中有一章專門討論“新興技術”,並引用了多篇學術論文,介紹一些未來可能用於驗證年齡的新方法。澳大利亞參議院目前正在進行一項調查,旨在進一步加強社交媒體禁令相關法律。在調查過程中,有人提交材料指出,這份報告至少存在兩處引用錯誤。材料稱,這些“引用似乎是由 AI 幻覺產生的,而不是基於真實來源”。

本月,《衛報》澳大利亞版就此事向 ACCS 詢問時,該機構發言人最初否認報告使用了人工智能,但隨後承認,團隊曾利用 AI 對部分段落進行改寫,使其表達更加簡潔。該發言人表示:“我們沒有使用 AI 生成報告或其中引用的材料…… 每一項材料都經過核查,確認鏈接和報告真實存在,並且與所引用的具體問題相關。”然而,《衛報》澳大利亞版自行分析這份報告後發現,僅在同一章節中就有 6 條參考文獻存在錯誤。

這些錯誤包括:部分數字對象標識符(DOI,即與特定學術論文對應的一組唯一字母和數字)鏈接到根本不存在的論文;部分 DOI 指向了錯誤的論文;作者姓名、期刊名稱和發表年份的組合與任何已知文獻都無法對應;還有一些 DOI 鏈接指向的論文,其內容並沒有得出報告所聲稱的結論。隨後,這名發言人對 ACCS 所依據的研究進行了進一步說明,並提供了新的參考文獻,但這次回應同樣存在錯誤。ACCS 提供的一份用於糾正報告原有引用的學術論文清單中,部分論文的發表年份、作者和期刊名稱與報告最初列出的引用並不一致。其中一篇被 ACCS 引用的論文據稱是在 2025 年 3 月訪問的。

然而,該研究的一名主要作者向《衛報》確認,這篇論文直到 2025 年 6 月正式發表後才對公眾開放。他還確認,ACCS 最初列為該論文主要作者的“Jamil”從未參與過這篇論文,而且 ACCS 的報告也錯誤地概括了這篇論文的內容。對於另一條無法在所引用期刊中找到的參考文獻“Weber et al.2011”,該發言人進一步解釋稱,這篇文獻曾被莫納什大學的一項研究引用,並向《衛報》提供了這項研究。然而,在 ACCS 提供的莫納什大學論文中,並沒有任何署名 Weber 的參考文獻。

直到《衛報》發現,報告 E 部分和 K 部分的 4 個鏈接包含元數據,顯示這些鏈接的來源為 ChatGPT 後,該發言人才承認報告確實使用了 AI。該發言人堅持認為,由於鏈接中保留了 ChatGPT 的元數據,機構實際上已經披露了 AI 的使用情況,而且這些鏈接本身是正確的,因此他們並不認為這是一個問題。他表示,AI 僅被用於讓部分段落的表達更加簡潔,並沒有用於開展原始研究,也沒有用於生成報告。“所有鏈接都經過檢查和驗證,如果其中存在無意的錯誤,我對此表示歉意,但整個過程都是由人工完成驗證的。”澳大利亞聯邦政府此前就曾對承包商在為政府撰寫報告時使用 AI 持負面態度。

德勤去年曾因報告出現錯誤而退還政府 44 萬澳元(現匯率約合 210.3 萬元人民幣)合同中的部分款項,該諮詢公司也承認曾使用 AI。《衛報》向 Wells 辦公室提出的問題隨後被轉交給其所在部門。該部門一名發言人上週五表示:“該部門正在審查下述問題,並將在適當情況下與 ACCS 進行溝通。”在當地時間上週五舉行的參議院調查聽證會上,相關部門官員表示,他們已經與 ACCS 會面。ACCS 聲稱,報告中的錯誤是因為一些原本能夠正常訪問的鏈接後來失效所導致的。不過,相關官員並未獨立核實這一說法,並表示要回頭檢查這些鏈接“非常困難”。

官員稱,在一份長達 1000 頁的報告中,涉及引用的內容只有 26 頁,其中只是出現了“少數錯誤”。該部門第一助理秘書 Sarah Vandenbroek 表示:“ACCS 向我們保證,在文件發佈時,所有鏈接都經過檢查,當時也都能夠正常訪問。因此,中間可能發生了一些變化。他們還向我們保證,即使部分鏈接已經失效,但相關原始文件仍然存在,這些引用依然有效。”澳大利亞國立大學監管與全球治理學院教授 Christian Downie 此前曾研究過政府收到的包含 AI 幻覺內容的提交材料。

他表示,如果政府收到的報告或提交材料被發現存在虛假引用,無論這些錯誤是否由 AI 造成,都可能導致政府作出錯誤決策,並“削弱公眾對政府機構的信心和信任”。他說:“人們應該認為,政府已經在考慮這個問題。未來可能需要通過合同條款以及相應的處罰措施,來阻止此類行為發生。”獨立參議員 Fatima Payman 表示:“去年德勤那份充斥 AI 垃圾內容的報告所引發的風波,本應該讓政府承包商在報告中隨意引用文獻的做法徹底結束。”她說:“政府必須要求負責這份報告的承包商道歉並退款。

” 投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:社交媒體禁令,ChatGPT不再僅限 API 密鑰:Codex 中的 GPT‑5.6 Sol 百萬上下文能力已可通過 ChatGPT 賬號使用ChatGPT 新功能:訂閱用戶無需離開對話,即可直接編輯谷歌雲盤文件7 月環比增 32%,弗萊爾稱 OpenAI 企業 AI 業務收入已超消費者業務中國醫生用 GPT-5.

6 破解 22 年數學難題,Crouzeix 本人確認正確不再依賴截圖記錄活動:Mac 版 ChatGPT 新增 Computer History AI 功能備戰 IPO 上市:彭博社稱 2026 年 OpenAI 年化營收有望翻番達 400 億美元

Related

相關文章

鈦媒體生成式AI

王興興“錯配”梁文鋒?

王興興“錯配”梁文鋒?字母榜2026.08.24 17:44 · 來自河北全文4818字00:00 / 13:21關於世界模型,宇樹和DeepSeek理念分歧明顯。文 | 字母榜宇樹科技的股價還在持續下跌。市值從上市首日的4449億元高點,跌至2400億元,截至8月24日收盤,市值較最高點蒸發了2000億元。然而比股價更值得關注的是,宇樹接下來要怎麼走。8月20日,也就是宇樹上市第二天,王興興出現在北京世界機器人大會論壇。十多分鐘的分享裡,AI成為了高頻詞彙。他談到AI實時生成、實時識別,也談到AI模型投入,更透露了宇樹正在預研的一件事:讓物理AI機器人實現“自進化”。王興興講的每一件事,最後都指向一個關鍵要素:AI大模型。特別是最後一點,王興興說,要實現“物理AI自進化”,要用目前最前沿、最頂尖的AI大模型來驅動。而這恰恰是宇樹目前不太擅長的部分。不過,宇樹找到了DeepSeek。今年8月,兩家公司已經達成合作,圍繞AI大模型與具身智能相關技術展開合作。說到具身智能公司和AI大模型公司的合作,就不得不提當年Figure AI和OpenAI的合作。2024年,OpenAI在投資Figure AI後,雙方簽署了三年合作協議,合作開發人形機器人AI模型。但是僅一年後,FigureAI終止合作,轉向自研。於是問題來了:王興興和梁文鋒,會不會重走Figure AI和OpenAI的老路?01為什麼宇樹需要DeepSeek?對於宇樹來說,過去幾年,模型研發已經有了一些積累,但顯然投入不足,進展緩慢,所以找到一個頂尖的AI大模型公司合作,是一個比較自然的選擇。先來看宇樹目前的模型研發進展。當前,具身智能大模型沒有一個統一的技術路線,但VLA和世界模型,是行業重點探索的兩個方向。行業甚至也在探索兩者融合的技術路線。宇樹也在摸索,採取了“兩條腿走路”的策略,並行研發兩種模型。所謂VLA(視覺

剛剛
量子位生成式AI

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”

阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

剛剛
IT之家生成式AI

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入

作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。

剛剛