SOURCE // NEWS

最新研究:AI创作的小说质量已超越人类,读者难辨真伪

最新研究:AI创作的小说质量已超越人类,读者难辨真伪

从荷马史诗到阿加莎的经典推理,人类的创意写作历史源远流长。然而,一项发表在《Judgment and Decision Making》期刊上的最新研究表明,生成式人工智能已经开始在文学创作领域向人类发起强力挑战。

在这项研究中,研究人员招募了 1682名 成年受试者,要求他们阅读六篇短篇小说中的一篇。其中三篇由人类作家撰写,另外三篇由 ChatGPT 生成,且AI故事在主题上与人类作品高度相似。研究人员向参与者告知了故事的作者属性(人类或AI),但故意混淆了部分真实标签,以测试主观偏见的影响。

实验结果令人惊讶:阅读了 AI生成故事 的参与者,对其吸引力和整体质量的评分显著高于阅读人类作品的参与者。然而,偏见依然存在——当参与者被告知某篇故事是由人类撰写时,他们给出的评分会普遍偏高。这表明,尽管AI的实际写作质量过硬,但人们对“人类创作”仍带有天然的保护滤镜。

论文资深作者、宾夕法尼亚州维拉诺瓦大学的 Deena Skolnick Weisberg 博士指出:“AI系统已经能够创作出被认为不亚于、甚至优于人类作品的短篇小说。我们应该据此更新对 AI文本生成能力 的认知。”作为一名创意写作实践者,她同时强调,这并不意味着人类应该完全把笔交给AI,因为技术生成的长篇小说在本质上可能与人类作品存在差异。

“我们需要为 AI生成小说 以及人机协同创作让出空间,但这并不意味着人类创造力的价值不复存在,”Weisberg 表示,“人类写作是一种自我表达、自我挑战或理解自身经历的方式,AI能够生成媲美人类的故事并不能剥夺这种体验。”研究还发现,对AI抱有积极态度的参与者,往往会给那些被标记为 ChatGPT 创作的故事打出更高的分数。

为了进一步验证,研究人员进行了另外两项实验,涉及 905名 成年人。每位参与者阅读两篇相同主题的短篇小说(一篇为人类创作,另一篇为AI生成),并猜测其作者身份。结果显示,在其中一项实验中仅有 40% 的人猜对(甚至低于随机概率),另一项实验的正确率也仅为 52%。研究人员指出,没有证据表明普通读者能够有效区分人类写作与AI生成的文本。

有趣的是,参与者自我评估的“文学专业造诣”与其猜测的准确性毫无关联;相反,对 AI技术 越了解的人,识别的准确率越高。Weisberg 解释道:“AI写作具有特定的文风,通过练习我们可以像识别不同人类作家的独特风格一样,逐步掌握 AI的写作模式。”

AgentUpdate 深度解析

这一研究不仅颠覆了传统文学界对AI创作能力的固有偏见,更对未来的 AI Agent(智能体) 生态提供了极具启发性的技术启示。当前,诸如 CrewAIAutoGPT 等多智能体协作框架正在尝试将内容生成从“单点Prompt输出”推向“多角色协同编辑”的 Agent 模式。如果基础语言模型(#LLM)仅凭单次生成就能在盲测中击败人类作家,那么通过规划(Planning)、反思(Reflection)以及多Agent对齐机制优化后的“Agent写作工坊”,其输出的文本在结构性、情感共鸣和逻辑一致性上将达到全新的高度。在未来的AI Agent生态中,智能体将不仅扮演“写作助手”,更将向“独立创作者”和“个性化内容分发中心”演进。这要求我们重新审视 人机协同(Human-in-the-Loop) 的边界,未来的核心壁垒将不再是单纯的文笔,而是人类独特的经历注入与提示词工程背后的价值观引导。