GPT-6发布引AGI定义争议,99.9%高分能否代表通用智能?
OpenAI于9月3日宣布GPT-6 Astra模型,其在定制测试环境下的表现引发关于AGI(通用人工智能)定义的广泛讨论。尽管OpenAI称其为'世界上最智能的模型',但基准测试机构ARC Priz...
2026年9月3日下午,OpenAI总裁Greg Brockman在闭门媒体沟通会上的一句话成为焦点:"欢迎来到AGI时代。" 这句看似简短的宣告,实则揭示了围绕"AGI"这一术语的长期争议与当前技术进展之间的微妙关系。
AGI的起源与演变
"AGI"(Artificial General Intelligence,通用人工智能)的概念最早可追溯至1956年的达特茅斯会议。当时约翰·麦卡锡提出"人工智能"一词,旨在让机器具备人类的全部智能。然而,随着技术发展,"人工智能"逐渐被泛化,从下棋程序到语音导购都被称为AI。直到2001年,研究者Shane Legg等人重新提出"Artificial General Intelligence"这一表述,强调具有通用能力的机器系统。2015年,OpenAI将AGI写入公司章程,将其定义为"在大多数有经济价值的工作上胜过人类的高度自主系统",并明确表示AGI应服务于全人类而非单一公司私有。
商业协议中的AGI条款
OpenAI与微软的合作协议中,AGI的定义与认定始终是核心议题。2019年OpenAI转型为有限利润结构后,微软投入巨额资金支持其研发。2023年投资协议中曾设定当系统创造千亿美元利润时终止独家授权,但2025年重组后,这一条款被取消,改为固定时间期限(2032年)。Brockman此次宣称"AGI时代"的到来,实际上反映了OpenAI对自身技术里程碑的宣告,但并未给出明确的认定标准。
GPT-6的表现与争议
上周四发布的GPT-6 Astra模型在OpenAI定制的测试环境(允许模型保留推理状态、使用独家技术管理长对话)中取得了99.9%的逆天高分,但在ARC Prize基金会的标准测试环境下,得分仅为62.7%。这种差异引发了业界对AGI认定标准的激烈讨论。芯片巨头黄仁勋直接在社交媒体上宣布"AGI已经到来",而OpenAI内部对此却保持谨慎态度。CEO奥特曼曾公开批评"AGI"一词过于模糊,总裁Brockman也强调这是"个人判断",最终裁定权交由用户决定。
技术进步与评估标准的矛盾
尽管GPT-6在动作效率上实现了突破(平均动作数比人类少51.7%),但ARC Prize基金会明确表示,仅在特定环境下取得高分并不能证明达到了AGI。未来AGI的认定标准可能需要更严格的跨环境测试,以及对模型泛化能力的全面评估。这一争议不仅关乎技术定义,也涉及商业利益分配和行业话语权争夺。
结语
GPT-6的发布及其引发的AGI定义争议,反映了人工智能技术快速发展与评估体系滞后之间的矛盾。随着技术不断突破,如何建立统一、客观的评估标准将成为行业共识的关键所在。