AI小說盲測勝過人類作品!讀者得知是ChatGPT後評價反而暴跌

記者吳立言/綜合報導

人工智慧生成小說與人類創作之間的差距,可能比讀者想像中更難辨識。最新研究讓數千名參與者閱讀由人類與 ChatGPT 生成的短篇小說,結果發現,在不知道真正作者身分的情況下,AI 作品獲得較高的品質與沉浸感評分;但當讀者被告知作品由 ChatGPT 創作後,評價反而下降。研究也發現,多數參與者無法單靠閱讀正確分辨 AI 與人類作品。

▲▼骨董,古董,古籍,古書,老書,舊書,舊書店,書店,圖書館,書櫃,書架,讀書,念書,研究。(圖/VCG)

▲研究曝AI小說盲測評價竟勝過人類作品。(圖/VCG)

研究測試 AI 與人類小說

[廣告]請繼續往下閱讀...

這項研究由 Sydney Sears 與 Deena Skolnick Weisberg 進行,題為《機器人還是人類:人們能分辨人類與 AI 系統撰寫的故事嗎?》的研究,目前已列入 Judgment and Decision Making 期刊文章,研究團隊也公開相關預印本與資料。

研究分為 3 項實驗。第一項實驗共有 1,498 名成年人參與,每人閱讀一篇約 1,000 字的短篇小說,作品來自人類作者或 ChatGPT。部分參與者被告知作品由人類創作,另一部分則被告知是 ChatGPT 生成,研究人員再要求他們評估作品品質與閱讀時的沉浸程度。

不知道作者時 AI 評分更高

結果顯示,參與者在不知道真實作者身分時,ChatGPT 生成的小說獲得較高的品質評分,沉浸感評分也高於人類作品。但作者標籤會明顯影響結果。不論作品實際上由誰創作,只要參與者被告知「這是人類寫的」,作品評分就會提高;反過來,當參與者被告知作品由 ChatGPT 創作,評價則相對下降。

這代表讀者對作品的評價不只受到文字內容影響,對作者身分的認知同樣可能改變最終評分。

讀者幾乎分不出真正作者

研究後續再進行兩項實驗,共有 905 名成年人參與。這次每名參與者都會同時閱讀一篇人類小說與一篇 AI 小說,再判斷兩篇作品各自的作者。結果顯示,參與者整體表現沒有高於隨機猜測的程度,也就是說,他們無法單靠閱讀內容穩定辨識出哪一篇是 AI 生成、哪一篇由人類創作。

不過,與 AI 的接觸經驗與辨識正確率呈正相關;相較之下,自認熟悉小說或文學作品的程度,並沒有呈現相同關聯。

AI 作品的「易讀性」可能影響評價

研究人員指出,AI 生成文字通常具有較流暢、容易閱讀等特徵,這些特性可能提高讀者對作品品質的評價,但並不代表 AI 已經在所有文學創作面向超越人類。短篇小說本身也可能影響結果。研究測試的是約 1,000 字的短篇作品,而不是完整長篇小說,因此研究結果主要反映 AI 在這類短篇創作上的表現,不能直接延伸為 AI 已經全面取代人類小說家。

這項研究最明顯的結果之一,是「作者是誰」會影響讀者如何看待同一類型的文字。AI 作品在不知道作者身分時可以獲得較高評價,但當讀者知道作品由 ChatGPT 生成後,評價便出現下降。

研究因此指出,AI 已經能夠生成讀者難以與人類作品區分的短篇創作,但讀者對 AI 創作能力的認知,與他們實際閱讀作品後的判斷之間仍存在落差。

分享給朋友:

追蹤我們:

※ 本文版權所有,非經授權,不得轉載。 [ ETtoday著作權聲明 ]

推薦閱讀

精彩短影精彩短影

more

熱門影音更多>>

女星貼身洋裝「下面凸一大包」 她不自在頻遮掩..韓網:造型師太過分

女星貼身洋裝「下面凸一大包」 她不自在頻遮掩..韓網:造型師太過分

黃豪平模仿蘿莉塔超像!

黃豪平模仿蘿莉塔超像!

金武烈選唱「想見你」神曲 ChatGPT推薦的

金武烈選唱「想見你」神曲 ChatGPT推薦的

【喪禮都辦完了】尼泊爾婦人活埋多日奇蹟生還 獲救畫面曝光

【喪禮都辦完了】尼泊爾婦人活埋多日奇蹟生還 獲救畫面曝光

【神曲響起】SJ-L.S.S.來開球!大跳《sorry sorry》全場氣氛超嗨

【神曲響起】SJ-L.S.S.來開球!大跳《sorry sorry》全場氣氛超嗨

讀者迴響

哪些AI工具支援繁體中文?

目前較主流的ChatGPT、Claude、Gemini、Perplexity、Copilot等都支援繁體中文,回覆也愈來愈自然。不過圖像生成工具有些還是以英文提示詞為主,使用時可留意。

最夯影音

更多

熱門快報

回到網頁頂端