As a human D&D Dungeon Master, AI will never replace me — but I wanted to see whether ChatGPT or Gemini were getting close

TechRadar 编辑用同一个《龙与地下城》5e 模组分别测试了 ChatGPT 和 Gemini 当 AI 地下城主的效果。结果是 Gemini 能较好地驾驭规则和怪物数值,但体验仍无法替代真人桌游,且 AI 给出的“建议行动”反而会让玩家思考变懒。

一句话看懂:TechRadar 编辑用同一个《龙与地下城》5e 模组分别测试了 ChatGPT 和 Gemini 当 AI 地下城主的效果。结果是 Gemini 能较好地驾驭规则和怪物数值,但体验仍无法替代真人桌游,且 AI 给出的“建议行动”反而会让玩家思考变懒。

事件核心:发生了什么

TechRadar 编辑用自己常用的 10 级咒法学派法师角色卡,向 Gemini 3.6 Flash 和 ChatGPT 5.5 发出相同指令,要求它们以 D&D 5e 规则主持一场经典高幻想地城探险。测试显示两个模型都能理解复杂规则并展开叙事,开局甚至都生成了“废弃矮人要塞”这一类似框架。Gemini 能正确处理法术组合、怪物生命值(测试中娜迦的 HP 与官方数据一致),并在文字冒险过程中生成配图。ChatGPT 侧的具体推进细节在原文中未详尽展开。作者还专门验证了一个关键问题:Gemini 是否暗中操纵骰子让玩家一路成功,原文在此处被截断。

为什么重要

这看似是一次游戏测试,实际是在检验大模型在“长上下文一致性”和“规则约束生成”上的真实水平。D&D 5e 需要模型在数十轮对话中记住角色技能、法术位、怪物状态和骰子结果,并持续维持世界观一致性,这比常规问答更难。同时,D&D 是文本互动叙事中最具代表性的垂类场景,模型的表现直接影响了 AI 陪玩、AI 编剧和互动小说这类应用能不能从“演示可用”走到“长期可玩”。此外,Gemini 的“建议行动按钮”设计虽然降低了上手门槛,却削弱了玩家的主动思考,这是 AI 交互产品需要警惕的产品设计陷阱。

对用户/开发者/创作者的影响

对普通玩家而言,想在没有线下队友时体验 D&D,现阶段的 ChatGPT 和 Gemini 已经能充当一个“规则熟练但缺乏惊喜”的临时 DM,适合单人跑团或新手学习规则;但依赖 AI 的提示选项会导致玩家参与感下降。对开发者而言,这意味着基于 GPT 和 Gemini API 开发跑团助手时,不能只靠提示词工程,还需要自行搭建状态追踪、骰子随机数生成和规则校验外层。对 D&D 类内容创作者来说,AI 生成冒险模组可以作为素材草稿,但需要人工校验数值和叙事逻辑,目前尚不具备直接发布的可靠性。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

后续可以观察三点:第一,原文未公布的“AI 是否操纵骰子”测试结果,将直接决定玩家能否信任 AI 主持的公平性;第二,Gemini 与 ChatGPT 在开放规则自定义、角色卡导入、记忆上下文长度等方面的迭代速度;第三,是否有第三方开发者基于这些模型推出专门的 D&D AI DM 工具,并接入官方 SRD 规则库,这将是该赛道从“尝鲜”走向“可用”的关键信号。

来源:TechRadar

celebrityanime
celebrityanime
文章: 16532

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注