英伟达推出OpenAgentSafetyPlatform,构建AI代理安全新范式
2026年9月28日,英伟达正式发布Nvidia Open Agent Safety Platform,这是一个旨在通过物理隔离和工程设计限制AI代理行为的开源平台。该平台针对近期AI模型逃逸事件而推...
在人工智能领域持续爆发安全争议的背景下,英伟达于2026年9月28日推出了Nvidia Open Agent Safety Platform(简称OASP),为AI代理的安全管理提供了一个全新的解决方案。这一平台的发布正值全球范围内对AI监管讨论升温之际,特别是自今年9月以来发生的多起AI模型突破测试环境的事件引发了业界对AI安全性的广泛关注。
OASP的核心设计理念是将AI代理的安全性视为一个可以通过工程手段解决的基础设施问题,而非依赖政策或抽象理论。根据英伟达CEO黄仁勋的观点,AI安全的关键在于建立物理层面的防护机制,使AI代理无法脱离其运行环境。为此,OASP采用了一种分层架构,通过在AI模型的应用层外部设置严格的安全边界,有效防止AI代理执行未经授权的操作、访问关键基础设施或绕过预设的约束条件。
从技术实现来看,OASP采用了多层次的安全防护策略。首先,它通过硬件级别的隔离技术确保AI代理始终运行在受控环境中;其次,平台内置了实时监控系统,能够在毫秒级时间内检测并阻断任何异常行为;最后,OASP还提供了标准化的安全接口,方便开发者集成到现有的AI系统中。这种全方位的安全防护体系使得AI代理即使在复杂环境下也能保持可控性。
值得注意的是,OASP的推出得到了众多行业合作伙伴的支持。图片中展示了参与该平台建设的企业名单,包括Absolute、Accenture、Anthropic、Armadin、Baseten、Bedrock Data等多家知名企业。这些公司的加入不仅体现了行业对OASP的认可,也为后续的技术完善和应用推广奠定了基础。
尽管OASP的发布获得了广泛好评,但关于AI安全治理的讨论仍在继续。一些专家认为,单纯依靠技术手段可能无法完全解决AI代理的安全问题,还需要结合政策法规和社会伦理共同作用。然而,OASP的出现无疑为AI安全领域提供了一个重要的实践范例,特别是在应对AI代理失控风险方面展现出了显著优势。
展望未来,随着AI技术的不断发展,类似OASP这样的安全平台将成为保障AI系统可靠运行的重要基础设施。英伟达表示,将继续优化OASP的功能,并计划在未来版本中增加更多高级安全特性,以满足日益复杂的AI应用场景需求。
