IT之家 8 月 9 日消息,從《奧德賽》到阿加莎 · 克里斯蒂的犯罪小說,人類創(chuàng)作了大量精彩故事,填滿了一代又一代人的書架。但一項研究表明,如今人工智能或許已經(jīng)開始成為人類作家的競爭對手。

發(fā)表在《判斷與決策》(Judgment and Decision Making)期刊上的一項研究顯示,研究人員邀請 1,682 名成年人閱讀 6 篇短篇小說,其中 3 篇由人類創(chuàng)作,另外 3 篇由 ChatGPT 創(chuàng)作。每篇 AI 小說都圍繞與其中一篇人類作品相似的主題展開。
研究人員會告訴參與者,他們閱讀的故事究竟由人類還是 AI 創(chuàng)作,但這一信息并不總是準確的。隨后,研究人員要求參與者評價故事的吸引力、閱讀體驗以及整體質(zhì)量。
結(jié)果顯示,閱讀 AI 生成故事的參與者認為這些故事更加引人入勝,質(zhì)量也高于閱讀人類創(chuàng)作故事的參與者。不過,當參與者被告知某篇故事是由人類創(chuàng)作時,他們反而會給出更高的評價。
該研究的主要作者、美國賓夕法尼亞州維拉諾瓦大學的 Deena Skolnick Weisberg 博士表示:“AI 系統(tǒng)已經(jīng)能夠創(chuàng)作短篇故事,而且人們認為這些故事至少不遜于人類創(chuàng)作的作品,甚至可能更好。我們應該據(jù)此重新認識 AI 的能力?!?/p>
不過,Weisberg 本人也是一名創(chuàng)作者。她表示,這并不意味著寫作應該交給 AI。她指出,科技公司利用 AI 創(chuàng)作的小說,很可能與人類作家創(chuàng)作的作品存在差異。
她說:“我們可能需要為 AI 創(chuàng)作的小說,以及 AI 與人類共同創(chuàng)作的小說留出空間,但這并不意味著人類創(chuàng)造的過程就不再值得欣賞。人類寫作是為了進行創(chuàng)造性的自我表達,是為了挑戰(zhàn)自己,也是為了理解和梳理自己的經(jīng)歷。AI 能夠生成類似人類創(chuàng)作的故事,并不會改變這些事情?!?/p>
研究結(jié)果還表明,人們對 AI 的態(tài)度也會影響評價。對 AI 持更加積極態(tài)度的參與者,在被告知故事由 ChatGPT 創(chuàng)作后,給出的評價高于那些對 AI 持較負面態(tài)度的參與者。
研究人員隨后又進行了兩項實驗,共有 905 名成年人參與。參與者會看到 6 篇短篇小說中的兩篇,這兩篇故事?lián)碛邢嗤黝},但只有其中一篇由人類創(chuàng)作。參與者需要判斷哪一篇由人類寫作,哪一篇由 AI 生成。
IT之家注意到,在其中一項實驗中,約 40% 的參與者猜對了,甚至低于隨機猜測的準確率;另一項實驗中的正確率則為 52%。
研究人員寫道:“沒有普遍證據(jù)表明,參與者能夠區(qū)分人類創(chuàng)作的故事和 AI 生成的故事。”
研究人員還發(fā)現(xiàn),參與者自稱的小說閱讀或?qū)懽鹘?jīng)驗,與他們判斷故事作者身份的準確程度沒有明顯關(guān)系;但對 AI 系統(tǒng)越熟悉的人,判斷準確率越高。
Weisberg 表示:“AI 寫作具有某種特定的風格,我們可以通過練習逐漸學會識別這種風格,就像我們可以學會辨認不同人類作者獨特的寫作風格一樣?!?/p>
Weisberg 認為,人們更喜歡被標注為“人類創(chuàng)作”的故事,可能與他們對真實性的追求有關(guān);但從實際閱讀體驗來看,人們之所以更喜歡 AI 生成的故事,可能是因為這些故事更容易閱讀和理解。
不過,未參與這項研究的英國伯明翰大學電影與創(chuàng)意寫作教授 Luke Kennard 強調(diào),AI 仍然是一個極具爭議的話題。
他說:“因為我們是人類,所以我們傾向于把 AI 擬人化,把它想象成某種發(fā)光的機器人,擁有一張善意且中立的面孔。但實際上,它只是基于海量被盜寫作數(shù)據(jù)庫運行的預測代碼,而這些代碼運行在規(guī)模龐大、成本高昂且具有破壞性的超大型數(shù)據(jù)中心中,并給周邊社區(qū)帶來災難性的影響?!?/p>
Kennard 還強調(diào),AI 并不是類似拼寫檢查工具或同義詞詞典那樣的普通“工具”,而是一種生存層面的威脅。
他說:“當然,只要提示詞寫得恰當,再經(jīng)過一些調(diào)整和潤色,它完全可以生成一首連貫、甚至令人愉悅的詩。畢竟,它的訓練數(shù)據(jù)來自數(shù)千年的人類創(chuàng)作成果,如果連這個都做不到,反而才令人尷尬。我想,我們真正應該問的問題是:這一切值得嗎?答案絕對是,也毫無疑問是 —— 不值得。”