ACCS给澳大利亚政府做的年龄验证报告翻车了,引用一堆假文献还甩锅AI,参议院正查呢。
负责测试澳大利亚社交媒体年龄验证技术的ACCS报告耗资348万澳元,由英国机构Age Check Certification Scheme开展。报告被指存在至少6条参考文献错误,包括DOI链接到不存在的论文、作者姓名与文献无法对应。ACCS最初否认使用AI,但在《卫报》发现链接元数据来自ChatGPT后承认曾用AI改写部分段落。澳大利亚参议院正就此事展开调查,以加强社交媒体禁令相关法律。此前德勤也曾因报告错误退还政府44万澳元合同款项。
支持澳大利亚青少年社交媒体禁令的报告存在多处引用错误,机构承认使用了 ChatGPT 编辑
IT之家 8 月 17 日消息,据《卫报》报道,负责测试澳大利亚社交媒体禁令背后相关技术的一份报告,其作者承认在编辑过程中使用了 ChatGPT,但否认报告中的多处引用错误是由人工智能“幻觉”造成的。 这项耗资 348 万澳元 (IT之家注:现汇率约合 1,662.9 万元人民币) 的年龄验证技术测试由总部位于英国的 Age Check Certification Scheme(ACCS)于去年开展,主要测试各种可能被社交媒体平台用于落实澳大利亚未满 16 岁用户社交媒体禁令的技术。 澳大利亚通信部长 Anika Wells 曾高度评价这份报告,称其展示了“许多有效的选择”,并为去年 12 月社交媒体禁令正式生效铺平了道路。 报告大部分内容来自作者对目前可用的各种年龄验证技术进行的实际测试,但其中有一章专门讨论“新兴技术”,并引用了多篇学术论文,介绍一些未来可能用于验证年龄的新方法。 澳大利亚参议院目前正在进行一项调查,旨在进一步加强社交媒体禁令相关法律。在调查过程中,有人提交材料指出,这份报告至少存在两处引用错误。材料称,这些“引用似乎是由 AI 幻觉产生的,而不是基于真实来源”。 本月,《卫报》澳大利亚版就此事向 ACCS 询问时,该机构发言人最初否认报告使用了人工智能,但随后承认, 团队曾利用 AI 对部分段落进行改写,使其表达更加简洁。 该发言人表示:“我们没有使用 AI 生成报告或其中引用的材料…… 每一项材料都经过核查,确认链接和报告真实存在,并且与所引用的具体问题相关。” 然而,《卫报》澳大利亚版自行分析这份报告后发现, 仅在同一章节中就有 6 条参考文献存在错误 。 这些错误包括:部分数字对象标识符(DOI,即与特定学术论文对应的一组唯一字母和数字)链接到根本不存在的论文;部分 DOI 指向了错误的论文;作者姓名、期刊名称和发表年份的组合与任何已知文献都无法对应;还有一些 DOI 链接指向的论文,其内容并没有得出报告所声称的结论。 随后,这名发言人对 ACCS 所依据的研究进行了进一步说明,并提供了新的参考文献,但这次回应同样存在错误。 ACCS 提供的一份用于纠正报告原有引用的学术论文清单中,部分论文的发表年份、作者和期刊名称与报告最初列出的引用并不一致。 其中一篇被 ACCS 引用的论文据称是在 2025 年 3 月访问的。然而,该研究的一名主要作者向《卫报》确认,这篇论文直到 2025 年 6 月正式发表后才对公众开放。他还确认,ACCS 最初列为该论文主要作者的“Jamil”从未参与过这篇论文,而且 ACCS 的报告也错误地概括了这篇论文的内容。 对于另一条无法在所引用期刊中找到的参考文献“Weber et al. 2011”,该发言人进一步解释称,这篇文献曾被莫纳什大学的一项研究引用,并向《卫报》提供了这项研究。然而,在 ACCS 提供的莫纳什大学论文中,并没有任何署名 Weber 的参考文献。 直到《卫报》发现,报告 E 部分和 K 部分的 4 个链接包含元数据,显示这些链接的来源为 ChatGPT 后,该发言人才承认报告确实使用了 AI。 该发言人坚持认为,由于链接中保留了 ChatGPT 的元数据,机构实际上已经披露了 AI 的使用情况, 而且这些链接本身是正确的,因此他们并不认为这是一个问题。 他表示, AI 仅被用于让部分段落的表达更加简洁,并没有用于开展原始研究,也没有用于生成报告 。 “所有链接都经过检查和验证,如果其中存在无意的错误,我对此表示歉意,但整个过程都是由人工完成验证的。” 澳大利亚联邦政府此前就曾对承包商在为政府撰写报告时使用 AI 持负面态度。德勤去年曾因报告出现错误而退还政府 44 万澳元 (现汇率约合 210.3 万元人民币) 合同中的部分款项,该咨询公司也承认曾使用 AI。 《卫报》向 Wells 办公室提出的问题随后被转交给其所在部门。该部门一名发言人上周五表示:“该部门正在审查下述问题,并将在适当情况下与 ACCS 进行沟通。” 在当地时间上周五举行的参议院调查听证会上,相关部门官员表示,他们已经与 ACCS 会面。ACCS 声称,报告中的错误是因为一些原本能够正常访问的链接后来失效所导致的。不过,相关官员并未独立核实这一说法,并表示要回头检查这些链接“非常困难”。 官员称,在一份长达 1000 页的报告中,涉及引用的内容只有 26 页,其中只是出现了“少数错误”。 该部门第一助理秘书 Sarah Vandenbroek 表示:“ACCS 向我们保证,在文件发布时,所有链接都经过检查,当时也都能够正常访问。因此,中间可能发生了一些变化。他们还向我们保证,即使部分链接已经失效,但相关原始文件仍然存在,这些引用依然有效。” 澳大利亚国立大学监管与全球治理学院教授 Christian Downie 此前曾研究过政府收到的包含 AI 幻觉内容的提交材料。他表示,如果政府收到的报告或提交材料被发现存在虚假引用,无论这些错误是否由 AI 造成,都可能导致政府作出错误决策,并“削弱公众对政府机构的信心和信任”。 他说:“人们应该认为,政府已经在考虑这个问题。未来可能需要通过合同条款以及相应的处罚措施,来阻止此类行为发生。” 独立参议员 Fatima Payman 表示:“去年德勤那份充斥 AI 垃圾内容的报告所引发的风波,本应该让政府承包商在报告中随意引用文献的做法彻底结束。”她说:“政府必须要求负责这份报告的承包商道歉并退款。”