长三角安全人工智能安徽省实验室发布三大AI安全解决方案
2026/09/21 15:52阅读量 4
9月19日,在第一届中国网络空间安全大会(CCSC 2026)期间,长三角安全人工智能安徽省实验室正式发布“星界”、“星驭”、“星鉴”三大AI安全解决方案。这三大方案分别针对大模型内容安全、智能体应用安全及AIGC生成内容传播可信度,构建了覆盖全生命周期的安全防护体系。该举措旨在应对AI技术快速发展带来的安全风险,推动AI安全治理技术的产业化落地。
事件概述
9月19日,第一届中国网络空间安全大会(CCSC 2026)高水平专题论坛——人工智能安全与应用治理论坛在安徽合肥举办。作为承办方之一,长三角安全人工智能安徽省实验室现场发布了面向AI安全治理的三大核心解决方案:星界、星驭和星鉴。同时,实验室主任刘俊华发表了关于AI安全治理技术进展与应用实践的主题演讲。
核心信息:三大解决方案详解
此次发布的三大方案覆盖了从模型研发、智能体运行到内容传播的全链路安全需求:
1. “星界”:大模型内容安全治理解决方案
- 定位:面向大模型全生命周期,提供一体化内容安全治理能力。
- 核心能力:
- 源头治理:通过训练数据清洗、安全价值对齐与模型安全增强,降低内生风险。
- 运行防护:应用内容安全护栏,实时识别并处置提示词攻击、违法违规内容等风险。
- 持续运营:通过风险监测、人工研判、快速干预与闭环优化,确保持续安全。
- 全程评测:贯穿全过程的安全评测,驱动安全能力提升。
- 适用场景:教育、医疗、汽车等行业的大模型应用,支持开源与闭源模型,兼容云端及私有化部署。
2. “星驭”:智能体应用安全解决方案
- 定位:面向各类智能体应用,构建攻防一体化的全生命周期安全治理方案。
- 核心能力:
- 身份与权限管理:明确执行主体、授权关系与操作边界。
- 上线前检测:通过Skill安全检测识别供应链风险,并在安全靶场进行自动化红队测试验证真实执行风险。
- 运行中监测:覆盖“输入—规划—执行”全过程,监测提示词注入、工具滥用、越权操作、敏感信息泄露及任务失控等风险,并进行分级处置。
- 事后审计:通过日志回放与全链路审计支撑复盘溯源。
- 适用场景:智能办公、金融及政务等智能体应用场景,支持Skill市场准入审核及企业仓库治理。
3. “星鉴”:AIGC内容可信传播治理方案
- 定位:面向AIGC内容传播与治理,构建覆盖文本、图像、音频、视频四大模态的一体化可信传播治理方案。
- 核心能力:
- 数字身份建立:通过内容标识与数字水印,为AI内容建立可验证的数字身份。
- 检测与核验:结合AI生成检测与有害内容识别,识别来源不明、深度伪造及违规内容。
- 追溯机制:贯通内容标识、检测核验与来源追溯,提升传播可信度。
- 适用场景:AIGC创作、内容平台、新闻媒体及社交传播等场景,支撑版权保护与来源核验。
产业实践与展望
长三角安全人工智能安徽省实验室依托安徽星盾智能科技有限公司建设,致力于构建人工智能安全治理和防护能力。在技术应用方面:
- 大模型防护:自2023年以来持续为讯飞星火大模型升级防护方案,实现“分级分类”安全防护。2025年已落地25个私有化项目,2026年日均调用次数突破数亿次。
- 智能体护航:推动智能体Skill扫描上线相关产品平台,保障业务安全。
- AIGC治理:积极推进隐式水印和AIGC生成检测,承建了工信部首个AIGC生成检测处置平台。
实验室认为,AI安全治理是场景刚需且快速增长的市场。未来需关注动态演进的AI安全风险,坚持开源开放,加强生态整体构建,以系统、智能、可落地的安全治理能力为人工智能产业发展筑牢底座。
