一句话看懂:2026 年 9 月 20 日,作者宝玉在公众号披露,他用 ChatGPT Pro 里的 GPT 6 Astra 生成了一份可直接打开的 HTML 文件,把《桃花源记》做成了连贯可漫游的 3D 网页,并附上完整提示词。这件事值得关注的地方不在“炫技”,而在于它展示了大模型一次性交付可交互成品的能力边界。
事件核心:发生了什么
据社区更新与作者自述,这次尝试基于 ChatGPT Pro 中的 GPT 6 Astra 完成。作者提供了一套较长的提示词,核心约束是“循文入境”:读者必须按原文顺序和人物行动完整走完全文,空间关系要真实连通,不能靠黑屏或瞬移切换场景。
交付结果是一个可直接在浏览器打开的 HTML 文件,把全文拆成 20 幕,支持连贯体验与逐章慢读,并可在“原文+白话”“只看原文”“只看白话”之间切换。打开后点右下角“循文入境”进入完整体验,从“缘溪行”出发,穿桃林、入洞、豁然开朗、进村做客、辞别,直到“后遂无问津者”。第一版朗诵用的是系统自带 TTS,效果偏平;作者随后将央视李立宏的真人朗诵音频转录为 SRT 字幕,把 MP3 与 SRT 一并交给 GPT,仅用一句指令完成替换。
为什么重要
目前公开信息显示,这次实践的价值在于“单次生成可交付产品”这件事本身。以往用大模型做内容,常见路径是模型出脚本、图像生成补素材、前端再手工拼接;这里模型直接产出了一个带时间轴、场景切换和视角控制的网页成品,前端工程、资源编排和文本结构被压缩进一次对话。它并不代表模型已经能替代完整的游戏或教育产品开发,但说明在中等复杂度、强文本约束的场景里,大模型的交付形态正在从“内容片段”转向“可运行文件”。对闭源旗舰模型的能力评估标准,也因此多了一个可验证的参照。
对用户/开发者/创作者的影响
对普通用户,这类 3D 网页提供了一种新形态的“课文伴读”——可拖视角、可控进度、可切换原文与白话,学习与背诵的入口变得更直观。对开发者,值得研究的不是提示词本身,而是它如何把空间关系、叙事顺序、音频时间戳这些约束写进需求;SRT 作为对齐音频与句子的中间格式,是一个低成本且可复用的做法。对内容创作者,这意味着古文、历史、诗词等强叙事素材可以较低成本转成可交互体验,但前提是手里有高质量音频与清晰的文本结构,系统 TTS 的短板会直接拖低整体观感。需要注意的是,生成出的 HTML 依赖浏览器和算力环境,目前公开信息未说明其可访问性与长期托管情况。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是这类“一次对话出一个可运行网页”的做法能否稳定复现,提示词在换模型或换题材后是否仍有效;二是真人音频与 GPT 结合的工作流是否会被更多创作者采用,进而形成音频版权与素材来源上的新问题;三是教育、出版等场景是否会跟进,把 3D 课文体验做成常规产品而非单次实验。


