Claude助阵!黑客团队72小时攻破OpenAI内部代码库
近日,网络安全初创公司Hacktron AI的研究人员借助Anthropic的Claude模型,在不到72小时内成功入侵OpenAI内部代码仓库。该事件揭示了AI辅助安全测试的新模式,并引发了关于AI...
近日,一起由AI辅助完成的网络安全事件引发业界关注。网络安全初创公司Hacktron AI的研究团队在7月25日通过一系列技术手段,成功入侵了OpenAI的部分内部系统,整个过程耗时不到72小时。
据《华尔街日报》报道,这次攻击始于OpenAI社区论坛所使用的第三方软件Discourse平台。研究人员发现,当处理特定HEIC格式图片时,Discourse依赖的libheif图像解码器存在未被标记为安全修复的堆缓冲区溢出漏洞。这一漏洞使得攻击者能够通过上传恶意图片文件实现远程代码执行。
"我们利用这个漏洞进入了托管OpenAI社区论坛的服务器,并获得了用户身份验证令牌。"Hacktron联合创始人兼CTO Mohan Pedhapati(推特名s1r1us)在社交媒体上详细披露了攻击过程。值得注意的是,这些获取到的令牌不仅可用于社区论坛,部分甚至属于OpenAI员工,进而可以访问其ChatGPT账户及GitHub服务。
"通过其中一名OpenAI员工的ChatGPT账户,我们进一步进入了OpenAI内部大型代码仓库Monorepo。"Pedhapati补充道。Monorepo作为OpenAI的核心代码仓库,存放着大量与算法和软件系统相关的代码,但不包含模型权重。
为了证明访问权限的真实性,Hacktron团队在Monorepo中提交了一个包含"Hacktron AI Team PoC"字样的Pull Request,随后立即停止了所有进一步操作。OpenAI方面表示,此次事件共发现两个独立的安全问题:一个来自Discourse平台,另一个源于OpenAI自身的SSO配置缺陷。
"尽管数月来人们一直警告人工智能系统的能力,但此次新的入侵事件表明,当今计算机系统的复杂性使其难以防御。"《华尔街日报》在报道中指出。OpenAI随后确认发现了这两个安全问题,并向Hacktron支付了6500美元赏金。
从技术路径来看,这并非简单的Claude"自主黑进"事件,而是一次人类主导、AI提供关键技术辅助的授权安全测试。Hacktron团队仅有三人,却能利用各自订阅的Claude和Codex服务,在短时间内完成漏洞分析、利用代码编写和攻击路径探索。
"过去可能需要高级安全研究人员完成的工作,如今可以由AI承担相当一部分。"OpenAI总裁格雷格·布罗克曼(Greg Brockman)在接受采访时表示,公司一度抽调约25%的生产工程师投入防御工作,并因此发现和修复了一些严重问题。
"我们正在制定一个框架,来说明如何报告、评估和部署期间出现的失准,包括那些看起来不像传统安全事件,但可能有助于洞察AI行为和未来风险的例子。"OpenAI在官方声明中表示,此次事件促使公司加快了对AI系统失准事件的标准化响应流程。
图2展示了完整的攻击链:从libheif图像解码器的漏洞开始,经过Debian缺失安全补丁环节,最终导致OpenAI内部代码库的访问。这一系列漏洞的叠加效应,使得原本看似微小的安全隐患演变成了严重的系统性风险。
图3显示了Hacktron团队在OpenAI内部代码库中提交的PoC Pull Request,内容包含"Hacktron AI Team PoC"字样,用以证明他们确实获得了相应的访问权限。
图4为OpenAI官方发布的声明截图,该公司表示正在开发针对AI失准事件的标准化响应框架。
这起事件不仅凸显了AI系统安全防护的脆弱性,也反映了当前网络安全领域正在发生的深刻变革。随着AI能力的不断提升,传统的安全防御体系正面临前所未有的挑战。专家建议,企业应加强对AI系统的安全审计,并建立更完善的漏洞报告和响应机制,以应对日益复杂的网络安全威胁。