研究:人們無法有效區分 AI 生成與人類原創短篇小說

作者:遠洋 責編:遠洋 評論: 8 月 9 日消息,從《奧德賽》到阿加莎 · 克里斯蒂的犯罪小說,人類創作了大量精彩故事,填滿了一代又一代人的書架。但一項研究表明,如今人工智能或許已經開始成為人類作家的競爭對手。發表在《判斷與決策》(Judgment and Decision Making)期刊上的一項研究顯示,研究人員邀請 1,682 名成年人閱讀 6 篇短篇小說,其中 3 篇由人類創作,另外 3 篇由 ChatGPT 創作。每篇 AI 小說都圍繞與其中一篇人類作品相似的主題展開。研究人員會告訴參與者,他們閱讀的故事究竟由人類還是 AI 創作,但這一信息並不總是準確的。
隨後,研究人員要求參與者評價故事的吸引力、閱讀體驗以及整體質量。結果顯示,閱讀 AI 生成故事的參與者認為這些故事更加引人入勝,質量也高於閱讀人類創作故事的參與者。不過,當參與者被告知某篇故事是由人類創作時,他們反而會給出更高的評價。該研究的主要作者、美國賓夕法尼亞州維拉諾瓦大學的 Deena Skolnick Weisberg 博士表示:“AI 系統已經能夠創作短篇故事,而且人們認為這些故事至少不遜於人類創作的作品,甚至可能更好。我們應該據此重新認識 AI 的能力。”不過,Weisberg 本人也是一名創作者。她表示,這並不意味著寫作應該交給 AI。
她指出,科技公司利用 AI 創作的小說,很可能與人類作家創作的作品存在差異。她說:“我們可能需要為 AI 創作的小說,以及 AI 與人類共同創作的小說留出空間,但這並不意味著人類創造的過程就不再值得欣賞。人類寫作是為了進行創造性的自我表達,是為了挑戰自己,也是為了理解和梳理自己的經歷。AI 能夠生成類似人類創作的故事,並不會改變這些事情。”研究結果還表明,人們對 AI 的態度也會影響評價。對 AI 持更加積極態度的參與者,在被告知故事由 ChatGPT 創作後,給出的評價高於那些對 AI 持較負面態度的參與者。研究人員隨後又進行了兩項實驗,共有 905 名成年人參與。
參與者會看到 6 篇短篇小說中的兩篇,這兩篇故事擁有相同主題,但只有其中一篇由人類創作。參與者需要判斷哪一篇由人類寫作,哪一篇由 AI 生成。注意到,在其中一項實驗中,約 40% 的參與者猜對了,甚至低於隨機猜測的準確率;另一項實驗中的正確率則為 52%。研究人員寫道:“沒有普遍證據表明,參與者能夠區分人類創作的故事和 AI 生成的故事。”研究人員還發現,參與者自稱的小說閱讀或寫作經驗,與他們判斷故事作者身份的準確程度沒有明顯關係;但對 AI 系統越熟悉的人,判斷準確率越高。
Weisberg 表示:“AI 寫作具有某種特定的風格,我們可以通過練習逐漸學會識別這種風格,就像我們可以學會辨認不同人類作者獨特的寫作風格一樣。”Weisberg 認為,人們更喜歡被標註為“人類創作”的故事,可能與他們對真實性的追求有關;但從實際閱讀體驗來看,人們之所以更喜歡 AI 生成的故事,可能是因為這些故事更容易閱讀和理解。不過,未參與這項研究的英國伯明翰大學電影與創意寫作教授 Luke Kennard 強調,AI 仍然是一個極具爭議的話題。他說:“因為我們是人類,所以我們傾向於把 AI 擬人化,把它想象成某種發光的機器人,擁有一張善意且中立的面孔。
但實際上,它只是基於海量被盜寫作數據庫運行的預測代碼,而這些代碼運行在規模龐大、成本高昂且具有破壞性的超大型數據中心中,並給周邊社區帶來災難性的影響。”Kennard 還強調,AI 並不是類似拼寫檢查工具或同義詞詞典那樣的普通“工具”,而是一種生存層面的威脅。他說:“當然,只要提示詞寫得恰當,再經過一些調整和潤色,它完全可以生成一首連貫、甚至令人愉悅的詩。畢竟,它的訓練數據來自數千年的人類創作成果,如果連這個都做不到,反而才令人尷尬。我想,我們真正應該問的問題是:這一切值得嗎?答案絕對是,也毫無疑問是 —— 不值得。
” 投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:AI,人工智能,AI寫作X 平臺將於 9 月 8 日推出全新“原創內容獎勵計劃”,要求至少擁有 500 名經過認證的粉絲才可參與曝亞馬遜利用 45 年前規劃繞過社區投票建設 AI 數據中心,美國加州吉爾羅伊市民不滿內部“一路綠燈”:消息稱 WorkBuddy 已成騰訊 AI 應用戰略優先級最高產品之一專為 AI 智能體打造的雲端瀏覽器,Cloudflare 發佈 Kitesurf微信 AI 助手“小微”再擴容,灰度測試朋友圈“幫寫”及“點評”功能OpenAI 下一代 AI 模型 Astra 數學成果遭抄襲指控
Related
相關文章

韶音首款 AI 耳機 OpenFit 2 AI 亮相雲棲大會,重磅首發“AI 實驗室”四大新功能
作為開放式耳機領域的領頭羊,Shokz 韶音首次重磅參展,不僅攜旗下首款 AI 耳機 OpenFit2AI 核心亮相,更在現場聯合光帆科技首發了“AI 實驗室”全新功能,全面展現了 Qwen 大模型在音頻可穿戴設備中的深度產業落地。作為韶音佈局智能音頻賽道的開山之作,OpenFit2AI 深度融合了通義千問(Qwen)大模型的強大能力,集長時錄音、AI 會議紀要生成與多語種實時翻譯於一體。

GPT-6 Sol和Luna上線,打折比梁文鋒還狠
字母AI2026.09.23 11:08 · 來自北京全文5453字00:00 / 14:27Opus 5.5發佈90分鐘,OpenAI來打價格戰了。文 | 字母AI今夜註定無眠。Opus 5.5剛剛發佈90分鐘,OpenAI就把GPT-6 Sol和Luna一起端了上來。前腳Anthropic剛把Opus的價格砍了一刀,後腳OpenAI直接把刀砍得更深。GPT-6 Sol每百萬Token輸入只要2美元、輸出10美元,價格正好只有Opus 5.5的一半,Astra的五分之一。Luna更誇張,只要0.1美元和0.

Claude Code v2.1. 280 落地:Opus 5. 5 正式接棒默認王座,百萬上下文配 4 美元骨折價把賬單壓進地心
最新推送的Claude Code v2.1.280版本里,Claude Opus5.5(claude-opus-5-5)正式被任命為默認Opus模型,這也讓前陣子開發者圈裡流傳的"跳級突襲"傳聞徹底塵埃落定。這枚新旗艦一口氣吞下100萬Token的上下文窗口,定價牌掛得異常兇悍:每百萬Token輸入4美元、輸出20美元,緩存讀取更是壓到每百萬Token0.

Meta Muse 爆紅,為什麼騰訊股價大漲?
深流研究所2026.09.23 10:39 · 來自北京全文3733字00:00 / 10:34扎克伯格等來爆款,騰訊跟著被重估。文 | 深流研究所,作者 | 吳絳楓Meta 在 AI 上砸下的重金,什麼時候才能拿到大結果?Muse 給出了第一個答案。

Opus 5.5來了,性能趕超Fable,成本低至40%
字母AI2026.09.23 10:31 · 來自北京全文4730字00:00 / 12:20被Astra“逼出來”的全新系列。文 | 字母AI5.5!!是Opus 5.5!!就在三天前,路透社還報道稱,隨著GPT-6 Astra開始搶回企業市場,Anthropic正在考慮提前推出一款新模型應戰。社區一直猜測新模型會是Opus 5.2還是5.5,現在答案終於揭曉了。而且這不是一個小更新,Anthropic直接掀開了Claude 5.5這個新系列。Opus 5.5先打頭陣,Sonnet 5.5和Haiku 5.

OpenRouter發佈 2026 嵌入模型選型指南:實測 19 款、 37 個目錄條目,按場景把最佳候選擺上桌
正因如此,選哪個模型永遠是RAG、多語言檔案庫、代碼倉庫和圖文集合各自不同的考題。OpenRouter在9月11日核實了自家嵌入模型目錄,共37個條目,並通過embeddings API向19個模型發了批量請求、跑了28項檢查,用一份實測指南把選型邏輯攤開。