长三角实验室发布三套人工智能安全治理方案
9月19日,第一届中国网络空间安全大会(CCSC 2026)人工智能安全与应用治理论坛在安徽合肥举行。长三角安全人工智能安徽省实验室发布“星界”“星驭”“星鉴”三套方案,覆盖大模型内容安全、智能体应用安全和AIGC可信传播。
该实验室由安徽省人民政府批准,依托安徽星盾智能科技有限公司建设。中国工程院院士吴世忠、科大讯飞胡国平、中国科学技术大学俞能海及实验室主任刘俊华共同参与发布。
“星界”面向大模型全生命周期,覆盖数据清洗、价值对齐、模型增强、上线评估、运行防护和持续运营,并通过安全护栏识别提示词攻击及违规内容,支持开源或闭源模型、云端或私有化部署,适用于教育、医疗、汽车等行业。
“星驭”针对智能体应用,以身份权限管理为基础,结合Skill检测、自动化红队测试和安全靶场,监测输入、规划、执行全流程中的提示词注入、工具滥用、越权、信息泄露及任务失控,并提供审计追溯能力,适用于办公、金融和政务场景。
“星鉴”面向文本、图像、音频、视频四类AIGC内容,通过数字水印和内容标识建立数字身份,再结合生成检测、有害内容识别及来源追溯,服务于内容创作、平台、媒体、社交传播和版权核验。
刘俊华在论坛上介绍,实验室正从数据源头推进价值对齐,建设一站式安全评测平台,并完善大模型、智能体防护和风险运营体系,同时通过内容嵌入与鉴别降低AIGC滥用风险。
自2023年以来,相关技术持续用于讯飞星火防护和行业策略制定,安全平台已接入多类开源及央国企大模型;2025年落地25个私有化项目,2026年日均调用量已超过数亿次。实验室还推进Skill扫描、隐式水印和生成检测,并承建工信部首个AIGC生成检测处置平台。
刘俊华表示,AI安全治理正成为规模化应用的刚性需求,也带来新的产业机会。面对持续演进的风险,产业各方需坚持开放协作,推动安全能力与新技术、新场景结合,为人工智能发展提供更系统、可落地的安全基础。
本文基于公开渠道信息整理,内容可能存在不准确或遗漏之处,不代表本站立场,如内容涉及侵权或错误,请联系我们处理。
阅读原文