9月20日消息,在第一届中国网络空间安全大会(CCSC 2026)人工智能安全与应用治理论坛上,长三角安全人工智能安徽省实验室发布“星界”“星驭”“星鉴”三大AI安全解决方案,分别面向大模型内容安全、智能体应用安全及AIGC生成内容可信传播。
其中,“星界”面向大模型全生命周期,覆盖数据构建、模型训练、应用上线及持续运营,通过训练数据清洗、安全价值对齐、模型安全增强、内容安全护栏及风险监测等方式,对提示词攻击、违法违规内容等风险进行识别和处置。该方案支持开源及闭源模型,可采用云端或私有化部署。
“星驭”主要面向智能体应用,以身份与权限管理为基础,在上线前进行Skill安全检测及自动化红队测试,运行过程中覆盖“输入—规划—执行”全流程,对提示词注入、工具滥用、越权操作、敏感信息泄露及任务失控等风险进行监测,并通过日志回放及全链路审计进行事后溯源。
“星鉴”则聚焦AIGC内容传播治理,覆盖文本、图像、音频、视频四类模态,通过内容标识、数字水印、AI生成检测及有害内容识别等技术,对AI生成及深度伪造内容进行识别,并提供来源追溯能力,可用于内容平台、新闻媒体及社交传播等场景。
长三角安全人工智能安徽省实验室主任刘俊华表示,实验室目前已围绕大模型内容安全、智能体安全及AIGC传播治理建立相关技术体系。据介绍,其大模型安全防护平台已支持多个开源大模型和央国企行业大模型接入,2025年落地25个私有化项目,2026年日均调用次数突破数亿次;同时,实验室还推进智能体Skill扫描、隐式水印及AIGC生成检测等技术应用,并承建了工信部首个AIGC生成检测处置平台。(定西)
热门跟贴