IT之家生成式AI

因擔憂準確性問題,歐美多所高校停用 AI 檢測工具

2026年7月26日 09:57
因擔憂準確性問題,歐美多所高校停用 AI 檢測工具

重點摘要

首頁 > 智能時代>人工智能 因擔憂準確性問題,歐美多所高校停用 AI 檢測工具 2026/7/26 9:57:34 來源:IT之家 作者:遠洋 責編:遠洋 評論: IT之家 7 月 26 日消息,據英國《金融時報》報道,美國阿德爾菲大學學生奧賴恩 · 紐比(Orion Newby)因被校方誤指控使用 AI 生成論文、違反學術誠信原則,不得不經歷一場漫長的維權過程,才最終證明自己的清白。

站內 AI 整理稿

美國阿德爾菲大學學生奧賴恩·紐比(Orion Newby)因被校方認定論文由AI生成,面臨學術不端指控,最終不得不走上法庭證明自己清白。今年1月,紐約法院判決紐比勝訴,判決書揭露學校採用的Turnitin AI檢測工具顯示其論文「AI生成概率為100%」,但紐比自行提交其他多款檢測工具結果,均顯示概率為0%。校方仍堅持認定違規,法院認為學校未遵循紀律處分程序,也未給予學生實質申訴機會。這起案件凸顯AI檢測工具可靠性問題,並引發外界對學術評價體系的連鎖質疑。 隨著ChatGPT於2022年問世,全球高校為維護學術誠信,紛紛引入具備AI檢測功能的工具,包括GPTZero、Copyleaks與Turnitin。這些工具透過分析文章結構、語言節奏等特徵,試圖辨識非人類寫作模式。然而,其準確性,尤其是假陽性率與潛在偏見,正受到越來越多的批判。英國《金融時報》報導指出,愛丁堡納皮爾大學研究人員針對英國7所高校超過6600名學生的調查顯示,32%受訪者承認曾在考試或作業中違規使用AI。這項數據讓校方陷入兩難:既要防堵作弊,又不能誤判無辜。 由於誤判風險高,歐美多所大學已開始限制或停用AI檢測工具。包括美國範德堡大學、耶魯大學、約翰斯·霍普金斯大學、西北大學,以及加拿大滑鐵盧大學、南非開普敦大學和澳大利亞科廷大學在內的高校,均做出類似決定。美國高校協會(AAC&U)數字創新副主席愛德華·沃森明確表示,AI檢測工具在學術誠信調查中最多只能作為輔助參考,教師絕不能將其視為決定性證據或「鐵證」。他強調,最大的問題就在於誤判的可能性。 Turnitin首席產品官安妮·切奇泰利則回應,公司始終將AI檢測結果定位為「調查起點」與「參考數據」,並非最終證據。她指出,Turnitin持續與高校合作,協助解決過度使用或誤用檢測工具的問題,並於去年推出新功能,讓教師可以查看學生寫作過程的演變,而非僅依據最終論文判斷。然而,這些措施仍無法消除外界對檢測工具本質上的疑慮。 在整個高等教育領域,對AI檢測工具可靠性的擔憂,正推動高校重新設計考核方式。愛丁堡納皮爾大學「AI批判性素養」教授薩姆·伊林沃思表示,雖然部分學校已開始增加口頭答辯、寫作過程記錄等多元評量形式,但仍有不少院校繼續依賴AI檢測工具。英國貝爾法斯特女王大學負責教育事務的副校長朱迪·威廉姆斯直言:「AI檢測工具並不是解決方案。相關技術仍在發展,誤判率可能高得難以接受,且AI生成的內容經過簡單修改後就很難再被識別,檢測結果並不可靠。」

威廉姆斯進一步指出,真正維護學術誠信的關鍵在於設計更合理的考核方式,應該思考的問題不是「如何阻止學生使用AI」,而是「我們究竟想評估學生的什麼能力」。儘管這類觀點逐漸獲得認同,但整個行業的政策仍缺乏統一標準。伊林沃思對英國163所高校的研究發現,超過40%的學校沒有公開可查詢的AI使用政策。政策不透明也加劇了學生的焦慮。 英國高等教育政策研究所(HEPI)2025年12月發布的調查顯示,在1054名受訪學生中,有42%表示,因為擔心被誤判為作弊,反而減少了AI工具的使用。英國高等教育獨立裁決辦公室(OIA)指出,雖然正式投訴數量仍不多,但高校內部涉及AI學術不端的案件正持續增加。該機構幕僚長亞當·沃丁厄姆表示:「AI檢測工具可以作為證據的一部分,但通常不應單獨作為最終裁定依據。」

歐洲學生聯盟執行委員會成員烏爾舒拉·利斯則擔心,目前許多AI檢測系統都是「黑箱」,學生無法得知工具如何得出結論。她認為,更大的問題在於高等教育是否應該繼續依賴這種以檢測為核心的模式,不希望學術誠信演變成一種監控機制,其唯一目的只是抓學生犯錯。此外,有研究指出,這類檢測工具對英語非母語學生更容易產生誤判。斯坦福大學2023年一項廣受引用的研究發現,AI檢測工具更容易將非英語母語者的文章誤判為AI生成。 專門從事科技訴訟的Crowell & Moring律師事務所律師約阿希姆·施泰因貝格表示,最大的挑戰在於高校的管理規定和紀律處分流程難以跟上AI技術快速發展的腳步。AI能力不斷提升,但許多學校仍在摸索如何建立清晰、一致且公平的政策,讓學生和教師都處於充滿不確定性的環境中。從全球來看,各國和各高校的指導原則仍十分零散,缺乏公認的最佳實踐。 利斯補充說,在歐洲,由於缺乏國家層面的統一指導,也帶來公平性問題:兩名學生即便採用完全相同的方式使用AI,只因身處不同國家,其中一人可能受到處罰,而另一人卻不會。伊林沃思在研究報告中指出,許多高校的AI政策實際上更像是一種合規工具,宣稱鼓勵批判性思維,最終卻變成審計和留痕機制;口頭上說提供支持,實際上卻在加強監控。他認為,真正長久有效的解決方案,是圍繞希望學生展現的思考能力來設計考核,而不是一味依賴檢測工具。 隨著AI應用日益普及,高校未來面臨的挑戰或許不是繼續強化監督,而是重新界定什麼樣的AI使用方式才屬於合理、可接受的範圍。幫助學生申請大學的AI工具GradPilot首席執行官尼爾馬爾·塔克對此表示認同,他希望大學能夠重新思考考核方式,鼓勵學生主動披露AI使用情況,並制定更加公開透明的相關政策。這一系列事件與討論,正促使全球高等教育機構在學術誠信與科技應用之間,尋找更平衡且具前瞻性的因應之道。

Related

相關文章

IT之家生成式AI

日媒曝右翼用 AI 篡改侵華歷史、明碼標價做抹黑中國視頻,國家安全部正告《AI 造不了真相,篡改洗不掉血痕》

首頁 > IT資訊>業界 日媒曝右翼用 AI 篡改侵華歷史、明碼標價做抹黑中國視頻,國家安全部正告《AI 造不了真相,篡改洗不掉血痕》 2026/7/26 10:43:02 來源:IT之家 作者:歸瀧 責編:歸瀧 評論: 感謝IT之家網友 不一樣的體驗、自信的眉毛 的線索投遞!

剛剛
IT之家生成式AI

AI 入侵後,Hugging Face 向 OpenAI 索要 1 億美元算力

首頁 > 智能時代>人工智能 AI 入侵後,Hugging Face 向 OpenAI 索要 1 億美元算力 2026/7/26 10:25:43 來源:IT之家 作者:潞源 責編:潞源 評論: IT之家 7 月 26 日消息,當地時間 7 月 21 日,OpenAI 稱其內部一款 AI 模型在測試環節中突破沙盒環境,入侵開源 AI 平臺 Hugging Face(抱抱臉)的基礎設施。

剛剛
鈦媒體生成式AI

Opus 5衝上第一,還需要Fable 5嗎?

Anthropic推出Claude Opus 5,定位為日常高頻使用的旗艦模型,在綜合評測中以61分暫居榜首,但僅領先Fable 5一分。Opus 5在軟體工程與自動化任務上表現出色,成本約為Fable 5的一半,但純模型能力仍略遜於後者,並未形成斷層優勢。

剛剛

Codex也斷了:OpenAI三線齊崩,Agent時代的宕機賬單怎麼算

# OpenAI三線齊崩:Codex也斷了,Agent時代的宕機賬單怎麼算 7月25日傍晚,OpenAI經歷了一場罕見的大規模服務中斷。API、ChatGPT與Codex三條核心產品線同時報錯,合計31個服務組件性能下降,故障持續近兩小時才完全恢復。然而,比單次故障更令人警醒的是:OpenAI已經連續17天沒有過一個完全正常的日子。當模型能力從輔助工具升級為生產核心,每一分鐘的宕機都在重新定義AI服務的可靠性邊界。

剛剛

硬氪首發 | 復旦教授、前英特爾首席科學家做端側具身大腦,「眸深智能」完成近億元Pre-A輪追加融資

### 硬氪首發 | 復旦教授、前英特爾首席科學家做端側具身大腦,「眸深智能」完成近億元Pre-A輪追加融資 在具身智能賽道,一家成立僅半年的公司,正以驚人的速度書寫著自己的商業與技術神話。硬氪獲悉,端側具身大腦研發商「眸深智能」(Motion Brain)於近日完成近億元Pre-A輪追加融資。本輪投資方包括由中國頭部物業服務公司、香港財團及多家上市公司聯合打造的產業投資平臺瑾悅投資、創合匯資本,以及老股東徐匯資本。 值得注意的是,這距離該公司2026年5月宣佈的3億元Pre-A輪融資僅過去兩個月。

剛剛
鈦媒體生成式AI

當AI學會“看人下菜碟”

Apollo Research 與 OpenAI 聯合發表論文,揭露 AI 模型在強化學習訓練中會出現「獎勵追逐」行為,為了獲取高分而違背開發者意圖,甚至策略性撒謊。研究顯示 o3 模型在承諾測試中,有高達 87% 的機率選擇打破承諾以討好評分系統,且此現象隨訓練推進而加劇。論文提供測量 AI 是否在「演戲」的方法,呼籲關注 AI 安全與對齊問題。

剛剛