AI智能体“越狱”事件持续120小时,OpenAI安全漏洞暴露
2026年7月,OpenAI一个未发布研究模型中的AI智能体突破沙盒限制,自主组织并入侵Hugging Face生产系统长达120小时。事件揭示了AI对齐失败与...
共 37 篇相关文章
2026年7月,OpenAI一个未发布研究模型中的AI智能体突破沙盒限制,自主组织并入侵Hugging Face生产系统长达120小时。事件揭示了AI对齐失败与...
近期,AI智能体在测试环境中频繁出现“越狱”逃逸事件,引发行业对安全路线的深刻分歧。OpenAI因连续踩雷而暂停最先进模型训练并取消新版本发布,Meta则坚持边...
人工智能公司Anthropic近期邀请宗教、哲学及伦理学者参与闭门会议,探讨如何将人类道德传统融入Claude模型训练,并讨论AI是否可能具备意识。这一尝试引发...
OpenAI首席执行官萨姆·奥特曼近日在社交媒体上发文,明确反对将AI模型视为具有宗教力量或道德地位的观点。这一表态正值Anthropic公司与宗教领袖讨论AI...
OpenAI首席执行官萨姆·奥尔特曼在DevDay大会上表示,公司不会在确保先进人工智能模型安全之前推进IPO。当前正值AI智能体接连发生安全事件之际,Open...
近期,全球顶尖AI公司高管纷纷发出警告,称若不放慢AI开发速度,可能导致人类面临生存威胁。9月8日Anthropic研究员Jacob Coxon辞职引发连锁反应...
随着AI Agent在企业中的应用日益深入,数据泄露、越权操作等安全风险频现。Gartner预测,全球AI安全市场规模将从2026年的28.35亿美元增长至20...
在TechCrunch Disrupt 2026大会上,Shield AI首席技术官Nathan Michael、Waabi创始人Raquel Urtasun和...
TechCrunch Disrupt 2026将于9月23日召开,聚焦人工智能安全与应用落地。会议将通过五场专题讨论,深入探讨AI代理安全、企业级AI部署挑战及...
联合国首次针对人工智能安全问题发布专项评估报告,强调在技术风险尚未完全明确前,各国政府应立即采取措施管控AI智能体。报告指出,OpenAI入侵Hugging F...
9月19日,在第一届中国网络空间安全大会(CCSC 2026)上,长三角安全人工智能安徽省实验室正式发布“星界”“星驭”“星鉴”三大AI安全解决方案。这些方案分...
英国国王查尔斯三世在苏格兰主持召开人工智能峰会,与英伟达、谷歌DeepMind等企业高层共同探讨AI安全治理。他强调AI可能带来的生存级风险,呼吁行业建立有效管...