OpenAI披露GPT-6Astra训练数据,黄仁勋称AGI已到来
OpenAI于9月3日首次公开GPT-6 Astra的训练细节,该模型在ARC-AGI-3等高难度测试中表现优异。英伟达CEO黄仁勋随即在社交媒体上宣布“AGI已到来”,引发业界对通用人工智能定义和实...
近日,人工智能领域迎来重要进展。OpenAI于9月3日首次披露其最新大模型GPT-6 Astra的训练数据和性能表现,这一消息迅速引发行业关注。根据OpenAI官方发布的数据,GPT-6 Astra在ARC-AGI-3基准测试中取得了99.9%的惊人成绩,这一数字远超此前同类模型的表现。
然而,这一突破性进展并非没有争议。OpenAI总裁格雷格·布罗克曼在发布声明时谨慎表示:“欢迎来到AGI时代。”但紧接着的补充说明却揭示了更复杂的现实:GPT-6 Astra的99.9%得分是在特定优化框架下获得的,而在标准测试环境中,其得分仅为62.7%。这种差异引发了关于AI评估标准的深入讨论。
“AGI不会以单一模型突破的形式到来,而是通过模型、记忆、工具和权限组合成的系统能力逐渐形成。”微软与OpenAI在2026年修改合作协议时已放弃等待一个“AGI触发事件”,转而采用固定时间点(2030年、2032年)终止合作条款,这表明行业巨头已开始务实处理商业关系。
英伟达CEO黄仁勋在社交媒体平台X上发表简短声明,直言“AGI已到来”。他透露,GPT-6 Astra是在约10万块英伟达Grace Blackwell NVLink72架构GPU上训练而成,从ChatGPT到o1再到Astra,仅用了四年时间。黄仁勋同时暗示,另有40万块GPU即将上线,这一表态被视为对OpenAI团队的祝贺,也隐含了对芯片未来销售的强劲预期。
“算力规模定义新里程碑。”黄仁勋的声明紧随OpenAI发布Astra模型之后。OpenAI称Astra为迄今最智能且对齐度最高的模型,在FrontierMath Tier 4、ARC-AGI-3等高难度基准测试中创下纪录,并在软件工程、网络安全及复杂专业任务中展现出高度独立性。
尽管黄仁勋的断言引发关注,但AI研究人员加里·马库斯等批评者指出,AGI的定义尚存争议。OpenAI总裁格雷格·布罗克曼在发布新模型后,特意强调“我们并不声称它就是AGI”。这种谨慎态度反映了当前学术界对AGI定义的分歧。
“真正的AGI社会影响可能先于任何实验室的正式宣布而发生。”Bainbridge“自动化的讽刺”理论预示,当企业围绕AI重新设计流程、削减人工冗余后,旧技能退化,组织将无法脱离AI正常运行。这意味着,AGI的影响可能已经悄然渗透到经济和社会的各个层面。
OpenAI此次披露的数据不仅展示了技术进步,也揭示了AI发展路径的新特点。GPT-6 Astra的成功并非单纯依赖模型本身,而是“模型+记忆+工具+权限”的系统能力共同作用的结果。这种组合式发展路径正在改变人们对AI的认知方式。
“测量单位应从模型转向系统生态。”生物学家提出的“反应规范”概念适用于AI研究:同一套权重在不同系统环境下产生不同能力表型。未来评测需为同一模型绘制环境-能力曲线,而非只给一个排名数字。人类智能本就依赖文字、计算器、制度等外部工具,AI系统亦然。
随着AI技术的快速发展,AGI的定义和实现标准仍在不断演变。OpenAI和英伟达的这次互动,不仅标志着技术上的重要突破,也反映了产业界对AI未来发展方向的深刻思考。