首页 > 资讯 > 美国政府AI被问《我的世界》为何答非所问

美国政府AI被问《我的世界》为何答非所问

赢政天下 2026-09-30 08:24 6 阅读 查看原文
美国政府AI被问《我的世界》为何答非所问

编者按:当一国政府的官方网站上线AI助手,公众最关心的问题往往不是它有多聪明,而是它会不会胡说八道。TechCrunch记者Amanda Silberling的一次偶然试探,意外揭开了政府级AI答问系统的一角:它没有崩溃,也没有发疯,只是被设计成了另一种样子。

一个方块游戏,难倒了政府的AI助手

事情的起点平平无奇。据TechCrunch报道,当用户在America.gov上向这个政府提供的AI助手提问有关《我的世界》(Minecraft)的问题时,得到的回应会变得非常奇怪——它要么绕开话题,要么抛出一段与问题几乎无关的官方口径式答复,语气生硬、逻辑跳跃,和它回答政策类问题时的表现判若两人。对于一款全球销量超过三亿份、几乎是当代青少年共同语言的沙盒游戏,一个号称能理解自然语言的AI助手表现得如此陌生,本身就足够反常。

乍看之下,这像是一次典型的模型幻觉:大语言模型遇到不熟悉的领域,就开始自行编织答案。但记者很快确认,这并不是故障。America.gov的异常表现是刻意设计的结果,而不是技术事故。

不是幻觉,而是护栏的副作用

要理解这件事,需要先理解大模型产品里的护栏(guardrails)机制。商业AI助手通常由三层结构约束:基础模型本身的安全对齐、系统提示词设定的行为边界、以及外围的输入输出过滤器。政府场景会把这三层都调到更保守的档位——话题白名单、关键词过滤、强制转介到官方服务页面,都是常见手段。当用户问出一个落在白名单之外、但又不属于敏感违规的问题时,系统往往不知道该如何体面地拒绝,于是就出现了那种答非所问的尴尬。

“出于国家安全的考虑,得知America.gov还没有幻觉到能长篇大论写诗的程度,着实让人松了一口气。”——原文摘要

这句话看似调侃,其实点出了问题的关键:公众对政府AI的底线期待,不是它多么博学,而是它至少不要一本正经地编造。一个只会支支吾吾的助手令人困惑,一个会自信地虚构法律条文、政策细节甚至历史事件的助手则可能造成实质伤害。从这个角度看,Minecraft事件虽然滑稽,却是相对安全的失败模式。

政府AI与商业AI,本就是两种生物

过去两年,各国政府都在快速引入大模型能力。美国政府通过总务管理局(GSA)推动的联邦AI采购试点,让多家模型厂商以极低价格向联邦机构开放服务;英国、新加坡、阿联酋也各自推出了面向公民的政务AI入口。这类系统与ChatGPT式产品的根本区别在于目标函数:商业产品优化的是用户留存与主观满意度,政务产品优化的则是零错误、口径可控与可审计。

后果就是,政务AI天然更容易“过度拒绝”。学术界把这种现象称为对齐税或过度安全(over-refusal):为了压住极小概率的有害输出,系统牺牲了大量正常交互的可用性。当一名家长只是想问“给孩子买哪款沙盒游戏合适”,却被一段关于网络安全政策的官话挡住,体验的损耗是真实存在的,只是它不体现在安全指标上。

当“不作恶”变成“不出错”

值得追问的是,为什么偏偏是Minecraft这类话题触发了异常?合理的推测有几种:其一,娱乐、游戏类查询被划入非政务范畴,系统被要求引导用户回到服务清单;其二,这类词可能落在某些内容过滤规则附近,比如涉及用户生成内容、联机服务器或模组修改;其三,模型被要求在任何不确定情形下优先复述既定表述,而不是自行组织语言。无论哪一种,问题都不在模型能力,而在产品设计对风险的定价方式。

与此同时,这起事件也提醒人们,用一个通用模型直接充当政府门户的对话层,本身就有架构层面的张力。模型的语言能力天生是发散的,政务需求天生是收敛的,把两者硬接在一起,接缝处必然出现这种不自然的表现。

公众信任才是真正的考题

从更宏观的视角看,America.gov被问《我的世界》时的怪异表现,是一个关于AI治理的小型寓言。政府部署AI的合法性来自透明度:公众有权知道系统能回答什么、不能回答什么、为什么会给出某个答复。一个对无伤大雅的问题含糊其辞、却不对用户解释原因的助手,即便技术上安全,也会在信任层面留下裂痕。

真正成熟的政务AI,应当做到拒绝时给出清楚的理由——“这个问题不在我的服务范围内,请前往某某页面”——而不是扮演出一种奇怪的答非所问。安全与可用并非零和,把边界明明白白写在墙上,比让用户去猜哪里有隐形的墙,代价更小,收益也更大。

本文编译自TechCrunch