普林斯顿学者与硅谷专家热议,AI未来十年或致人类灭绝风险
近日,普林斯顿大学两位学者就AI潜在威胁发表观点,指出未来十年内AI可能导致人类灭绝的概率超过10%。这一警告引发硅谷科技公司高管及安全专家的广泛讨论,部分人士呼吁暂停AI发展速度,加强行业协作。
在人工智能技术快速发展的背景下,一项关于AI潜在威胁的讨论正在全球科技界掀起波澜。2026年9月,普林斯顿大学计算机科学家Ben Lovejoy在其文章中指出,根据Anthropic公司的内部评估,AI在未来十年内导致人类灭绝的概率已超过10%。这一数字引发了广泛关注,并促使多位硅谷科技界人士公开表态。
事件起源于AI研究员Jacob Coxon的辞职声明。这位曾在OpenAI和Anthropic工作的研究者表示,两家公司都清楚AI系统可能在未来十年内对人类构成致命威胁,但他认为这些公司并未采取足够措施来防范这种风险。Coxon的帖子迅速获得超过1亿次浏览,随后Anthropic的安全负责人Evan Hubinger公开回应称,自己也认为AI在未来十年内导致人类灭绝的概率超过10%,并承认公司尚未找到解决超级智能对齐问题的有效方案。
这场争论不仅限于公司内部,还迅速蔓延至公众视野。著名AI科学家杰弗里·辛顿、约书亚·本吉奥等人都加入了讨论,将焦点从单纯的超级智能风险扩展到AI智能体的欺骗行为、网络攻击能力以及漏洞利用等多个层面。9月12日,Anthropic首席执行官Dario Amodei公开呼吁AI行业放慢发展步伐,这一主张得到了埃隆·马斯克和萨姆·奥特曼的支持,但也引发了激烈的争议。
面对日益升温的担忧,AI行业开始探索新的安全机制。9月15日,在All-In Summit 2026上,马斯克提出了一项创新性建议:让SpaceX、OpenAI、Anthropic、Google、Meta等主要AI公司互相测试对方的模型。这一想法虽然简单,却触及了AI安全的核心难题——当一家公司的模型强大到足以发现其他测试方案中的漏洞时,如何判断其安全性?Amodei提出的解决方案是引入独立的第三方评估人员进入AI公司内部,获得接近员工级别的权限,检查安全措施并直接报告重大问题。
与此同时,OpenAI、Anthropic和Google DeepMind等公司已经开始围绕AI安全展开沟通,但目前尚无正式的合作机制。这反映出AI行业面临的现实困境:如果每家公司都有自己的安全标准,那么所谓的“安全”很容易变成一道内部题。随着模型能力跨越公司边界,单靠一家公司制定规则越来越难以覆盖所有风险。
前DeepMind研究员Bilal Chughtai也在社交媒体上表达了类似担忧。他指出,AI的发展速度已经远远超过了业内对对齐问题的理解速度,必须控制发展节奏以确保新出现的风险能够在极端危害发生前得到解决。Chughtai强调,需要提高AI开发过程的透明度,并让更多人参与到AI发展方向的讨论中。
这场关于AI安全的辩论不仅涉及技术层面的问题,更触及了伦理和社会治理的深层议题。随着AI技术不断突破,如何平衡技术创新与人类安全成为亟待解决的难题。尽管目前尚未形成统一的解决方案,但这场讨论无疑为AI行业的未来发展指明了方向。