一句话看懂:澳大利亚政府耗资348万澳元委托的年龄验证技术测试报告,被曝出由ChatGPT改写,且报告“新兴技术”章节出现多处虚假引用。ACCS初始否认使用AI,在《卫报》发现ChatGPT元数据后才承认,引发对AI生成内容进入政府决策链条的信任危机。
事件核心:发生了什么
ACCS是一家英国测试机构,受澳大利亚政府委托开展年龄验证技术测试,这份报告被用于支撑面向16岁以下澳大利亚用户的社交平台禁令。ACCS起初坚决否认使用人工智能,但《卫报》在报告链接中发现了ChatGPT元数据,ACCS随后承认用ChatGPT重写了部分报告内容。
问题不只是“润色”。报告“新兴技术”章节有6处引用错误:有的DOI指向不存在的论文,有的链接到完全不相干的文档,作者、期刊、年份的组合也无法匹配任何已知研究。更离谱的是,ACCS后来提交的“更正清单”本身也有年份和作者错误。其中一篇论文的主要作者明确表示,自己从未参与相关研究,论文实际发表时间也晚于报告声称的访问时间。
为什么重要
这件事的核心不是“用了AI”,而是AI生成的虚假信息进入了政府决策依据。大模型即便只是被要求“让语言更简洁”,也可能在改写过程中顺带编造作者、年份、DOI这类结构化信息,也就是典型的AI幻觉。当幻觉内容嵌入千页官方报告并被政策制定者采信,问题就从技术缺陷升级为公共信任风险。
值得注意的是,澳大利亚政府对承包商的此类行为已有前例:去年德勤因AI幻觉错误退还44万澳元合同款。ACCS强调“千页报告只有26页涉及引用”“只出现几个错误”,这种解释很难平息外界对AI辅助公文可信度的质疑。学术界警告称,无论是人工失误还是AI所致,虚假引用都会误导决策,并进一步削弱公众对政策依据的信任。
对用户/开发者/创作者的影响
对开发者而言,这是一个AI幻觉进入正式交付物的典型样本:即使用户只调用了文本改写能力,大模型也可能在



