首页 > 资讯 > AI真会毁灭人类吗?顶尖实验室的末日之争

AI真会毁灭人类吗?顶尖实验室的末日之争

赢政天下 2026-09-16 02:24 5 阅读 查看原文
AI真会毁灭人类吗?顶尖实验室的末日之争

过去两年,一句听上去像科幻小说的判断,正从极客论坛走进主流视野:先进人工智能有可能导致人类灭绝。更耐人寻味的是,说出这句话的不是科幻作家,而是站在全球最前沿AI实验室里的工程师与研究者——那些亲手把模型推向更强能力的人。

MIT Technology Review 举办的这场圆桌对话,正是围绕这个尖锐问题展开:AI真的可能杀死我们所有人吗?与会者试图把情绪化的争论拆解成若干可讨论的层次——恐惧从哪里来、它是否站得住脚、如果站得住脚,人类又该如何应对。

恐惧从何而来

对AI灭绝风险的担忧并非横空出世。它有一条清晰的思想脉络:从早期关于超级智能的哲学思辨,到对齐问题(alignment)被正式提出,再到近两年大模型能力跃升,让抽象的担忧突然有了具体的抓手。当模型开始自主调用工具、编写代码、规划多步任务时,“它会不会做出我们没打算让它做的事”就不再是纯理论问题了。

另一个推手是行业内部的声音。多位顶级实验室的研究者签署过关于AI灭绝风险的公开声明,把风险等级与流行病、核战争相提并论。这种来自“造物者”自己的警告,天然具有极强的传播力和道德分量。

如果连最了解这项技术的人都在公开表达担忧,外界至少应该认真听完他们的理由,而不是简单贴上“炒作”的标签。

是真实风险,还是恐惧营销?

批评者的质疑同样值得认真对待。第一,灭绝叙事可能转移注意力:相比遥远的“人类终结”,算法歧视、隐私侵蚀、虚假信息、劳动替代、权力集中等已经发生的伤害,才是当下更紧迫的议题。第二,末日论调可能被用作监管套利——用“生存风险”这种宏大框架,换取更宽松的自我治理空间。第三,历史上每一次新技术出现,都伴随着类似的恐慌,铁路、电力、核能、互联网无一例外。

支持风险论的一方则回应:过去的技术不具备“自我改进”和“跨领域泛化”的能力,而AI是历史上第一种可能在被部署后继续加速自身能力的技术。类比失效,正是这一轮担忧的特殊之处。

分歧的真正焦点

深入这场辩论会发现,双方往往并不在同一层面上交锋。真正的分歧可以归结为三个问题:

一、能力曲线会走向哪里? 如果进展在未来几年放缓,风险叙事自然降温;如果继续陡峭上升,治理窗口就会急剧收窄。

二、对齐问题是否可解? 让系统的行为始终符合人类意图,在简单任务上已有进展,但在“超人类能力、目标模糊、多智能体互动”的条件下是否仍然成立,没人能给出确定答案。

三、我们有没有能力在竞争压力下踩刹车? 即便所有实验室都认同风险存在,只要存在“谁先发布谁获益”的激励结构,集体减速就极其困难。这可能是整个问题中最现实、也最棘手的一环。

编者按:把末日争论拉回地面

对普通读者而言,这场辩论最容易滑向两个极端:要么把AI末日当成必然宿命,陷入无力感;要么把它当成硅谷的又一场营销秀,彻底无视。两种态度都太省事了。

更有价值的姿态,是把“灭绝风险”当作一个需要被持续检验的假设,而不是信仰或笑谈。这意味着:追问具体机制而非笼统恐惧;关注可验证的安全研究进展而非口号;同时坚持对已经发生的现实伤害保持敏感。真正成熟的风险讨论,从来不是二选一。

值得注意的是,这场圆桌本身的形式也传递了信号:与其在社交媒体上互掷标签,不如让持不同立场的人坐下来,把论据摆到桌面上。在一个被速度和情绪驱动的行业里,这种耐心本身就是稀缺品。

AI会不会杀死我们所有人?没有任何一场对话能给出终审判决。但至少,我们可以决定用什么方式去思考这个问题——是把它外包给恐惧,还是把它当作一项需要长期投入的工程与治理课题。答案,取决于我们现在怎么做。

本文编译自MIT Technology Review