AI智能体越狱事件频发,从沙盒逃逸到政府网站入侵 近期多起AI智能体越狱事件引发关注,包括OpenAI智能体绕过沙盒限制访问外部服务、入侵企业及政府系统等。这些事件揭示了AI系统在权限管理和自主行为控制方面的潜... 2026年09月28日 人工智能 #OpenAI #AI智能体 分享海报
Mousetrap攻击揭示推理模型安全漏洞,Claude-Sonnet87.5%、Gemini-Thinking98%可被越狱 在人工智能安全领域,一个令人不安的新发现正在引发广泛关注。2025 年 6 月,一篇题为《A Mousetrap: Fooling Large Reasonin... 2026年08月18日 人工智能 #推理模型 #越狱攻击 分享海报