这项由维拉诺瓦大学的Sydney Sears和Deena Skolnick Weisberg博士领导的研究,通过Prolific平台招募了2500多名年龄在18至81岁之间的成年人。研究使用了三位已出版人类作者的三篇原创短篇小说,以及ChatGPT生成的三篇对应故事,这些故事在体裁和叙事元素上都进行了匹配。
研究分为三个部分,每个部分旨在隔离读者感知的不同方面:
实验结果在各个部分中惊人地一致:
Weisberg博士解释了为什么AI写作在这些指标上可能表现优于人类作品:AI写作“往往更清晰、更直接、更易于处理”,而人类创作的故事“通常更加微妙和复杂”。她补充说,“人们通常更喜欢可预测性,因为理解困难或微妙的材料需要更多的脑力”。
该研究建立在越来越多关于AI生成文本如何被感知的证据之上。AI创作的散文倾向于避免歧义,遵循可预测的叙事结构,并高效地提供解决方案——所有这些特质都让阅读变得毫不费力。相比之下,人类小说常常拥抱复杂性、微妙性和未解决的张力,即使它在艺术上更丰富,但可能难以带来即时的满足感。
研究中发现的“亲人类”偏见尤其值得注意。读者会惩罚他们认为由AI撰写的故事,即使其内容与他们在“人类”标签下赞扬的故事完全相同。这种归因偏差造成了一个悖论:坦诚公开使用AI的学生可能面临可信度惩罚,尽管他们的作品质量很高;而那些隐瞒AI使用的学生,则可能受益于读者对“人类作者身份”的偏好。
这项研究的发现对大学及其学术诚信政策提出了根本性挑战:
Weisberg博士强调,这些发现并不会使人类作者过时:“人类写作是一种创造性自我表达的形式,是为了挑战自己,或是为了理解我们的经历。AI能生成类似人类的故事这一事实并不会改变这一点”。