长三角安全人工智能实验室发布三大AI安全方案,覆盖大模型与AIGC全链路
9月19日,在第一届中国网络空间安全大会(CCSC 2026)上,长三角安全人工智能安徽省实验室正式发布“星界”“星驭”“星鉴”三大AI安全解决方案。这些方案分别针对大模型内容安全、智能体应用安全及A...
在人工智能技术快速发展的背景下,其安全问题日益成为产业关注的焦点。9月19日,第一届中国网络空间安全大会(CCSC 2026)的人工智能安全与应用治理论坛在安徽合肥举行,标志着AI安全治理进入新阶段。作为承办方之一,长三角安全人工智能安徽省实验室在现场发布了三大AI安全解决方案——“星界”“星驭”“星鉴”,为AI技术的安全应用提供了系统性解决方案。
其中,“星界”面向大模型全生命周期,通过训练数据清洗、安全价值对齐、模型安全增强等手段,降低内生风险;在应用运行中,通过内容安全护栏实时识别和处置提示词攻击、违法违规内容等风险;持续运营中则通过风险监测与人工研判实现快速干预与闭环优化。该方案支持开源与闭源模型,兼容云端及私有化部署,适用于教育、医疗、汽车等行业的大模型应用场景。
“星驭”聚焦智能体应用安全,以身份与权限管理为基础,上线前进行Skill安全检测及自动化红队测试,运行过程中覆盖“输入—规划—执行”全流程的风险监测与分级处置,事后通过日志回放与全链路审计支撑复盘溯源。该方案可应用于智能办公、金融及政务等场景,围绕数据防泄漏、权限管控、工具调用与行为审计提供安全保障。
“星鉴”则专注于AIGC内容传播治理,覆盖文本、图像、音频、视频四大模态,通过内容标识与数字水印建立可验证的数字身份,结合AI生成检测与有害内容识别,研判内容违规风险,贯通内容标识、检测核验与来源追溯。该方案可用于AIGC创作、内容平台、新闻媒体及社交传播等场景,提升内容传播的可信度与可追溯性。
长三角安全人工智能安徽省实验室主任刘俊华在会上表示,实验室已围绕大模型内容安全、智能体安全及AIGC传播治理建立相关技术体系,并承接了工信部首个AIGC生成检测处置平台建设任务。当前,AI技术的阶跃与产业应用的拓展正在加速,随之而来的安全问题也日益严峻,影响和制约了AI的进一步发展。实验室将持续构建并完善AI安全治理和防护产品体系,护航人工智能技术和产业发展。
此次发布的三大AI安全方案,不仅体现了实验室在AI安全领域的技术积累,也为行业提供了可落地的安全实践路径。随着AI技术在自动驾驶、智能办公、医疗健康等领域的广泛应用,如何保障其安全性和可靠性已成为产业发展的关键议题。未来,AI安全治理将需要政府、企业、科研机构等多方协同,共同构建安全可信的AI技术生态。