文章摘要
9月19日,在合肥举办的第一届中国网络空间安全大会人工智能安全与应用治理论坛上,承办方长三角安全人工智能安徽省实验室发布星界、星驭、星鉴三款AI安全解决方案,分别覆盖大模型内容安全治理、智能体应用安全防护、AIGC内容可信传播三大核心场景,构建全链路AI安全治理能力,相关技术已实现规模化产业落地,业内提出需全行业多方协同共建AI安全治理生态。

9月19日,第一届中国网络空间安全大会(CCSC 2026)下设的人工智能安全与应用治理论坛在安徽合肥正式举办。作为本次论坛的承办方之一,长三角安全人工智能安徽省实验室现场发布了三款针对性AI安全解决方案,分别覆盖大模型内容安全治理、智能体应用安全防护以及AIGC生成内容可信传播三大核心场景。同时,实验室主任刘俊华带来了题为《AI安全治理技术进展与应用实践》的主题分享,详细介绍了实验室在AI安全领域的最新技术突破与产业落地成果。

长三角安全人工智能安徽省实验室是经安徽省人民政府批准,依托相关科技企业建设的高能级科创平台,专注于人工智能安全治理与防护技术的研发与落地,助力AI技术与产业的健康发展。成立以来,实验室已斩获多项AI安全领域的权威奖项、专业认证以及顶级评测竞赛的冠军成绩,围绕AI安全治理的核心挑战展开技术攻关,持续完善安全治理与防护产品体系。

论坛现场,多位行业嘉宾共同上台见证了三大解决方案的正式发布,包括中国工程院院士吴世忠、国内AI领域技术负责人、高校相关领域教授以及实验室主任刘俊华等。此次发布的三款方案分别为:面向大模型全生命周期的内容安全治理方案“星界”、覆盖智能体全生命周期的安全防护方案“星驭”,以及面向AIGC内容传播治理的可信方案“星鉴”。

星界解决方案针对大模型的完整生命周期打造一体化内容安全治理能力,覆盖数据构建、模型训练、应用上线以及持续运营全流程。在研发阶段,通过训练数据清洗、安全价值对齐与模型安全增强,从源头降低AI内生安全风险;在应用运行阶段,通过内容安全护栏实时识别并处置提示词攻击、违法违规内容等各类安全威胁;在持续运营阶段,通过风险监测与人工研判快速发现问题,实现闭环优化与持续迭代。同时,安全评测将贯穿整个流程,持续验证并驱动安全能力的提升。该方案可适配教育、医疗、汽车等多个行业的大模型应用场景,支持开源与闭源两类模型,兼容云端部署与私有化部署模式,能够满足不同用户的差异化安全治理需求。

星驭解决方案则聚焦各类智能体应用,构建了覆盖全生命周期的攻防一体化安全治理体系。方案以身份与权限管理作为核心底座,能够清晰明确智能体的执行主体、授权关系与操作边界。在智能体上线前,通过Skill安全检测识别供应链层面的潜在风险,并在安全靶场中通过自动化红队测试验证真实的执行风险;运行阶段则覆盖“输入—规划—执行”的全流程,对提示词注入、工具滥用、越权操作、敏感信息泄露以及任务失控等风险进行实时监测与分级处置;事后还可通过日志回放与全链路审计实现复盘溯源,保障智能体安全稳定运行的同时兼顾业务可用性。该方案可应用于智能办公、金融、政务等智能体场景,围绕数据防泄漏、权限管控、工具调用与行为审计提供全面安全保障,同时支持Skill市场准入审核、企业Skill仓库治理以及开发阶段的安全自检。

星鉴解决方案面向AIGC内容的传播与治理,打造了覆盖文本、图像、音频、视频四大模态的一体化可信传播治理体系。通过内容标识与数字水印技术,为AI生成内容建立可验证的数字身份;针对来源不明的内容,结合AI生成检测与有害内容识别技术,精准识别AI生成内容与深度伪造内容,研判违规风险。方案贯通了内容标识、检测核验与来源追溯全链路,有效提升AIGC内容传播的可信度与可追溯性,可应用于AIGC创作、内容平台、新闻媒体以及社交传播等多个场景,为AI内容标识、生成与深度伪造检测、有害内容识别以及来源追溯提供技术支撑,同时也可为版权保护与来源核验提供可靠依据。

AI安全治理孕育产业新机遇,需多方协同共建生态

在主题分享环节,刘俊华详细介绍了实验室在AI安全治理领域的核心技术进展与落地实践。他表示,实验室目前已在多个关键维度完成技术布局:在内生安全领域,从数据源头构建了大模型价值对齐体系;在评测体系建设方面,持续完善并打造了一站式安全评测平台;在安全防护层面,为大模型内容与智能体安全搭建了完整的防护体系,筑牢风控运营的最后一道防线;在传播治理方面,则通过嵌入与鉴别双管齐下的方式,有效防范AIGC内容的非法滥用。

当前AI技术的规模化行业应用为AI安全治理带来了刚需与发展土壤,实验室的技术积累与核心产品已在实际应用中得到充分验证。自2023年起,实验室持续为国内主流大模型升级安全防护方案并制定行业安全策略,实现了分级分类的安全防护体系;其打造的大模型安全防护平台已支持多个开源大模型以及央国企行业大模型的接入,截至2025年已落地25个私有化部署项目,2026年日均调用次数突破数亿次。同时,实验室推动智能体Skill扫描相关产品上线平台,为业务安全保驾护航;在AIGC治理领域,积极推进隐式水印与AIGC生成检测技术研发,并承建了国内首个工信部下属的AIGC生成检测处置平台。

刘俊华在分享中提到,AI安全治理正孕育着全新的产业机遇,这是一个场景需求明确、增长速度快的市场。但同时也要注意到,AI安全风险始终处于动态演进的过程中,需要全行业各方共同参与共创,坚持开源开放的理念,加强AI安全治理生态的整体构建,才能更好地护航AI产业的健康发展。

从大模型到智能体,从内容生成到内容传播,AI安全已经成为AI规模化应用的重要基础能力之一。此次三大AI安全解决方案的集中发布,是长三角安全人工智能安徽省实验室推进技术产品化与产业化的重要里程碑。未来,实验室将持续聚焦人工智能发展中的新技术、新场景与新风险,深化关键技术创新,推动AI安全能力与产业应用深度结合,以更系统、更智能、更具落地性的安全治理能力,为人工智能产业的高质量发展筑牢坚实的安全底座。

以上内容不代表本平台立场,仅供读者参考