Mousetrap攻击揭示推理模型安全漏洞,Claude-Sonnet87.5%、Gemini-Thinking98%可被越狱 在人工智能安全领域,一个令人不安的新发现正在引发广泛关注。2025 年 6 月,一篇题为《A Mousetrap: Fooling Large Reasonin... 2026年08月18日 人工智能 #越狱攻击 #推理模型