AI真会毁灭人类吗?MIT专家深度解答

AI真会毁灭人类吗?MIT专家深度解答

在人工智能飞速迭代的当下,一个曾经只出现在科幻小说里的问题,如今被摆上了主流媒体的圆桌:AI真的会杀死我们所有人吗?

2026年9月,MIT Technology Review为订阅者举办了一场名为「Roundtables」的线上直播活动,主题正是这个当下几乎人人都在追问的问题。然而,30分钟的活动时间远远不够——与会者提出的问题之多、之尖锐,远超主办方预期。于是,该刊资深AI编辑Will Douglas Heaven与同事Grace Huckins在会后整理并回答了那些未能现场解答的疑问。

一场被问题淹没的圆桌

MIT Technology Review的Roundtables系列一向以「直面争议」著称,而这一次的话题无疑是最沉重的。活动原定30分钟,但订阅者的问题从「AI是否会失控」到「我们该不该害怕大模型的自我进化」,再到「监管是否已经太晚」,几乎覆盖了AI存在性风险的每一个角落。

这种焦虑并非空穴来风。过去几年,从OpenAI到Anthropic,从DeepMind到Meta,顶尖AI实验室的负责人们频频在公开场合谈论「灭绝风险」。2023年,数百位AI科学家与行业领袖联合签署声明,将AI灭绝风险与核战争、大流行病并列为全球性威胁。这类表述一方面提升了公众警觉,另一方面也制造了巨大的认知混乱:AI到底是一个工具,还是一个正在苏醒的对手?

「人们最想问的,其实不是AI会不会杀死我们,而是我们是否还能控制它。」——这正是圆桌活动上反复出现的潜台词。

恐慌与理性之间的第三条路

Will Douglas Heaven在回应中强调,讨论AI风险时最容易犯的错误,是把「存在性风险」与「现实危害」混为一谈。前者指向的是极端低概率、极端高影响的场景——比如一个超级智能系统摆脱人类控制;后者则是已经在发生的具体问题——算法歧视、深度伪造、就业冲击、信息污染。

把这两者混在一起,会导致两种极端:一种是对AI风险彻底麻木,认为「天塌下来有高个子顶着」;另一种则是陷入末日叙事,把每一次模型升级都看作倒计时的钟声。Heaven倾向于第三条路:既认真对待极端风险的研究,也不放弃对当下危害的治理。

这也是当前AI安全领域的一条主线分歧。所谓的「AI安全」阵营内部,大致可以分为两派:一派聚焦于对齐研究,试图确保未来超级智能的目标与人类价值一致;另一派则更关注现实中的权力集中、监管俘获与技术滥用。两派并非水火不容,但在资源分配与政策优先级上常有摩擦。

为什么公众的问题比答案更重要

值得注意的是,这次圆桌活动真正有价值的部分,或许不是专家给出的答案,而是订阅者提出的问题本身。当普通用户开始追问「模型是否具备欺骗能力」「开源是否会加速失控」「我们如何验证一家公司的安全承诺」,说明AI风险的讨论正在从学术圈和董事会下沉到公共领域。

Grace Huckins在整理问答时也提到,很多提问者并不满足于「是」或「否」,他们想要的是机制层面的解释:模型如何被训练、如何被评估、如何被约束。这种对细节的渴求,恰恰是理性讨论的基础。

与此同时,行业本身也在发生变化。越来越多的模型卡、系统卡、红队报告被公开发布,AI公司开始尝试用透明度换取信任。但这些举措是否足够,仍然存疑。批评者指出,自我评估永远无法替代独立审计,而当前的监管框架在跨国AI公司面前显得力不从心。

编者按:别让恐惧替代理性

回到那个最初的问题——AI真的会杀死我们所有人吗?诚实的回答是:没有人知道,但正因为不知道,才更需要认真研究,而不是简单站队。

把AI等同于末日,会让人忽视那些已经发生的、可以被缓解的危害;把AI风险当作危言耸听,则会让我们在真正需要未雨绸缪时措手不及。MIT Technology Review这场圆桌的意义,不在于给出一个确定答案,而在于示范了一种态度:面对未知,保持追问,保持严谨,也保持谦逊。

对于普通读者而言,最实用的建议或许是:关注具体机制,而非抽象恐惧;关注可验证的承诺,而非华丽的宣言。AI是否会毁灭人类,也许在很长时间内都不会有定论,但我们可以决定,用什么样的方式去讨论它。

本文编译自MIT Technology Review