读者给AI生成的短篇小说评分高于人类作品,直到得知是机器所写。

一项覆盖 2500 多人、包含三组对照实验的研究发现,读者不仅分不清 ChatGPT 和人类写的短篇小说,还会在不知情的情况下给 AI 文本打更高分;可一旦知道作者是机器,评价就会明显回落。

一句话看懂:一项覆盖 2500 多人、包含三组对照实验的研究发现,读者不仅分不清 ChatGPT 和人类写的短篇小说,还会在不知情的情况下给 AI 文本打更高分;可一旦知道作者是机器,评价就会明显回落。

事件核心:发生了什么

The Decoder 报道了这项发表在《Judgment and Decision Making》期刊上的研究,作者是 Sears 和 Weisberg。研究包含三个实验,总计超过 2500 名参与者。第一个实验中,1682 名参与者每人阅读一篇约 1000 词的短篇小说:三篇来自知名文学杂志和短篇小说集,另外三篇由 ChatGPT 4.0 根据原文主题、风格和叙事视角生成。参与者会被事先告知作者是人类还是 AI,但这一信息在部分组别中是假的。

结果显示,AI 生成文本在“感知质量”和“沉浸感”两个维度上都显著高于人类作品:感知质量得分 1.54 对 0.97,沉浸感得分 1.42 对 1.00(评分区间为 -3 到 +3)。在另外两个实验中,905 名参与者同时阅读人类和 AI 写的故事并要求区分来源,结果依然与随机猜测无异。值得注意的是,自称熟悉 AI 系统的参与者正确识别来源的比例更高,而自称熟悉小说的参与者并没有表现出明显优势。

为什么重要

这项研究把“AI 写得比人好”和“读者觉得 AI 写得比人好”这两件事区分开了。AI 文本更流畅、更易读、情绪也更正面,这些特点容易让人给出高分,但这不等于文学意义上的“更好”。人类作者,尤其是高质量文学作者,往往会有意增加阅读难度,逼迫读者参与意义建构。研究同时发现,作者标签会显著改变评分:只要告诉参与者作者是人类,分数就会更高;当 AI 态度积极的参与者被告知故事来自 ChatGPT,评分又会进一步上升。这种“来源偏见”与此前关于 AI 诗歌的研究结论一致。

对生成式 AI 行业来说,这意味着内容质量评估不能只看用户反馈,还要考虑披露框架。一个产品是否标明“AI 生成”,本身就会改变用户感知,影响工具的商业化路径和内容分发策略。

对用户/开发者/创作者的影响

对创作者而言,这是明确的竞争信号:在短内容领域,AI 生成文本已经能在“易读性”和“情绪感染力”上占据优势,标签可能是人类作品目前最重要的保护机制之一。对开发者和平台设计者来说,标注“AI 参与”不应被视为简单的合规要求,而是一个会直接影响用户评分、收藏和付费行为的界面变量。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

内容平台如果强制公示 AI 作者身份,可能导致作品被低估;反过来,完全不披露又可能引发信任争议。真正需要设计的不是“是否披露”,而是“在哪个环节、以什么方式披露”,以及如何帮助读者建立对 AI 辅助创作更稳定的评价标准。

10 月一项来自 Stony Brook 大学和哥伦比亚法学院的研究也补充了另一面:当模型针对特定作者风格微调后,专业读者在风格模仿上以 8 倍比例偏好 AI 文本,在写作质量上也以 2 倍比例偏好 AI 文本。说明模型越了解个人风格,专业判断受到的冲击就越明显。

值得关注的后续

短期可以关注三个方向:第一,AI 生成短故事是否会率先在快节奏内容领域规模化落地,比如网文、剧本杀脚本、营销叙事和儿童读物;第二,针对个人作者风格训练模型是否会被视为版权侵权或新的创作工具形态,现有法律框架并未完全覆盖;第三,平台对 AI 内容的披露机制会如何演变——是简单标注,还是像“人工审核”“创意辅助”这样更细致的分级。

来源:The Decoder AI News

celebrityanime
celebrityanime
文章: 18306

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注