IT之家生成式AI

因擔憂準確性問題,歐美多所高校停用 AI 檢測工具

2026年7月26日 09:57
因擔憂準確性問題,歐美多所高校停用 AI 檢測工具

重點摘要

首頁 > 智能時代>人工智能 因擔憂準確性問題,歐美多所高校停用 AI 檢測工具 2026/7/26 9:57:34 來源:IT之家 作者:遠洋 責編:遠洋 評論: IT之家 7 月 26 日消息,據英國《金融時報》報道,美國阿德爾菲大學學生奧賴恩 · 紐比(Orion Newby)因被校方誤指控使用 AI 生成論文、違反學術誠信原則,不得不經歷一場漫長的維權過程,才最終證明自己的清白。

站內 AI 整理稿

美國阿德爾菲大學學生奧賴恩·紐比(Orion Newby)因被校方認定論文由AI生成,面臨學術不端指控,最終不得不走上法庭證明自己清白。今年1月,紐約法院判決紐比勝訴,判決書揭露學校採用的Turnitin AI檢測工具顯示其論文「AI生成概率為100%」,但紐比自行提交其他多款檢測工具結果,均顯示概率為0%。校方仍堅持認定違規,法院認為學校未遵循紀律處分程序,也未給予學生實質申訴機會。這起案件凸顯AI檢測工具可靠性問題,並引發外界對學術評價體系的連鎖質疑。

隨著ChatGPT於2022年問世,全球高校為維護學術誠信,紛紛引入具備AI檢測功能的工具,包括GPTZero、Copyleaks與Turnitin。這些工具透過分析文章結構、語言節奏等特徵,試圖辨識非人類寫作模式。然而,其準確性,尤其是假陽性率與潛在偏見,正受到越來越多的批判。英國《金融時報》報導指出,愛丁堡納皮爾大學研究人員針對英國7所高校超過6600名學生的調查顯示,32%受訪者承認曾在考試或作業中違規使用AI。這項數據讓校方陷入兩難:既要防堵作弊,又不能誤判無辜。由於誤判風險高,歐美多所大學已開始限制或停用AI檢測工具。

包括美國範德堡大學、耶魯大學、約翰斯·霍普金斯大學、西北大學,以及加拿大滑鐵盧大學、南非開普敦大學和澳大利亞科廷大學在內的高校,均做出類似決定。美國高校協會(AAC&U)數字創新副主席愛德華·沃森明確表示,AI檢測工具在學術誠信調查中最多只能作為輔助參考,教師絕不能將其視為決定性證據或「鐵證」。他強調,最大的問題就在於誤判的可能性。Turnitin首席產品官安妮·切奇泰利則回應,公司始終將AI檢測結果定位為「調查起點」與「參考數據」,並非最終證據。

她指出,Turnitin持續與高校合作,協助解決過度使用或誤用檢測工具的問題,並於去年推出新功能,讓教師可以查看學生寫作過程的演變,而非僅依據最終論文判斷。然而,這些措施仍無法消除外界對檢測工具本質上的疑慮。在整個高等教育領域,對AI檢測工具可靠性的擔憂,正推動高校重新設計考核方式。愛丁堡納皮爾大學「AI批判性素養」教授薩姆·伊林沃思表示,雖然部分學校已開始增加口頭答辯、寫作過程記錄等多元評量形式,但仍有不少院校繼續依賴AI檢測工具。英國貝爾法斯特女王大學負責教育事務的副校長朱迪·威廉姆斯直言:「AI檢測工具並不是解決方案。

相關技術仍在發展,誤判率可能高得難以接受,且AI生成的內容經過簡單修改後就很難再被識別,檢測結果並不可靠。」

威廉姆斯進一步指出,真正維護學術誠信的關鍵在於設計更合理的考核方式,應該思考的問題不是「如何阻止學生使用AI」,而是「我們究竟想評估學生的什麼能力」。儘管這類觀點逐漸獲得認同,但整個行業的政策仍缺乏統一標準。伊林沃思對英國163所高校的研究發現,超過40%的學校沒有公開可查詢的AI使用政策。政策不透明也加劇了學生的焦慮。 英國高等教育政策研究所(HEPI)2025年12月發布的調查顯示,在1054名受訪學生中,有42%表示,因為擔心被誤判為作弊,反而減少了AI工具的使用。英國高等教育獨立裁決辦公室(OIA)指出,雖然正式投訴數量仍不多,但高校內部涉及AI學術不端的案件正持續增加。該機構幕僚長亞當·沃丁厄姆表示:「AI檢測工具可以作為證據的一部分,但通常不應單獨作為最終裁定依據。」

歐洲學生聯盟執行委員會成員烏爾舒拉·利斯則擔心,目前許多AI檢測系統都是「黑箱」,學生無法得知工具如何得出結論。她認為,更大的問題在於高等教育是否應該繼續依賴這種以檢測為核心的模式,不希望學術誠信演變成一種監控機制,其唯一目的只是抓學生犯錯。此外,有研究指出,這類檢測工具對英語非母語學生更容易產生誤判。斯坦福大學2023年一項廣受引用的研究發現,AI檢測工具更容易將非英語母語者的文章誤判為AI生成。專門從事科技訴訟的Crowell & Moring律師事務所律師約阿希姆·施泰因貝格表示,最大的挑戰在於高校的管理規定和紀律處分流程難以跟上AI技術快速發展的腳步。

AI能力不斷提升,但許多學校仍在摸索如何建立清晰、一致且公平的政策,讓學生和教師都處於充滿不確定性的環境中。從全球來看,各國和各高校的指導原則仍十分零散,缺乏公認的最佳實踐。利斯補充說,在歐洲,由於缺乏國家層面的統一指導,也帶來公平性問題:兩名學生即便採用完全相同的方式使用AI,只因身處不同國家,其中一人可能受到處罰,而另一人卻不會。伊林沃思在研究報告中指出,許多高校的AI政策實際上更像是一種合規工具,宣稱鼓勵批判性思維,最終卻變成審計和留痕機制;口頭上說提供支持,實際上卻在加強監控。他認為,真正長久有效的解決方案,是圍繞希望學生展現的思考能力來設計考核,而不是一味依賴檢測工具。

隨著AI應用日益普及,高校未來面臨的挑戰或許不是繼續強化監督,而是重新界定什麼樣的AI使用方式才屬於合理、可接受的範圍。幫助學生申請大學的AI工具GradPilot首席執行官尼爾馬爾·塔克對此表示認同,他希望大學能夠重新思考考核方式,鼓勵學生主動披露AI使用情況,並制定更加公開透明的相關政策。這一系列事件與討論,正促使全球高等教育機構在學術誠信與科技應用之間,尋找更平衡且具前瞻性的因應之道。

Related

相關文章

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

1 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

2 小時前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

2 小時前

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了

2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。

2 小時前