三大AI安全解决方案,在合肥正式发布!
9月19日,第一届中国网络空间安全大会(CCSC 2026)的高水平专题论坛——人工智能安全与应用治理论坛在合肥正式举办。作为承办方之一,长三角安全人工智能安徽省实验室在现场发布了三大AI安全解决方案星界、星驭、星鉴,覆盖大模型内容安全、智能体应用安全与AIGC生成内容传播可信三个领域。

长三角安全人工智能实验室作为由安徽省人民政府批准,依托安徽星盾智能科技有限公司建设的高能级科创平台,致力于构建人工智能安全治理和防护能力,护航人工智能技术和产业发展,已收获多项AI安全领域的权威奖项、认证和评测竞赛冠军。实验室面向AI安全治理关键挑战攻关,持续构建并完善AI安全治理和防护产品体系。
论坛现场,中国工程院院士吴世忠,科大讯飞联合创始人、技术委员会主任胡国平,中国科学技术大学教授、长三角安全人工智能安徽省实验室首席科学家俞能海,长三角安全人工智能安徽省实验室主任刘俊华共同上台,正式发布面向AI安全治理的三大方案:大模型内容安全治理解决方案“星界”、智能体应用安全解决方案“星驭”、AIGC内容可信传播治理方案“星鉴”。
据介绍,“星界”面向大模型全生命周期,提供数据构建、模型训练、应用上线、持续运营一体化内容安全治理。源头通过数据清洗、价值对齐、模型安全增强降低内生风险;运行中通过内容安全护栏识别处置提示词攻击、违法违规内容;运营中通过风险监测、人工研判,实现闭环优化。适用于教育、医疗、汽车等行业,支持开源、闭源模型及云端、私有化部署。
“星驭”面向智能体应用,构建全生命周期攻防一体化方案。以身份权限管理为底座,上线前通过Skill安全检测、安全靶场自动化红队测试验证风险;运行中覆盖“输入—规划—执行”,监测分级处置提示词注入、工具滥用、越权操作、敏感信息泄露、任务失控;事后日志回放、全链路审计。应用于智能办公、金融、政务等,并支持Skill市场准入审核、企业Skill仓库治理。
“星鉴”则是面向AIGC内容传播治理,覆盖文本、图像、音频、视频。通过内容标识与数字水印建立可验证数字身份;结合AI生成检测与有害内容识别,识别深度伪造,贯通标识、检测核验与来源追溯。可用于AIGC创作、内容平台、新闻媒体、社交传播等场景。

现场长三角安全人工智能安徽省实验室主任刘俊华还带来题为《AI安全治理技术进展与应用实践》的演讲,分享了AI安全治理核心技术的最新进展及产业应用实践成果。他表示,实验室在内生安全上从数据源头构建大模型价值对齐体系,同时持续建设和完善评测体系、构筑起一站式安全评测平台,并且为大模型内容和智能体安全搭建安全防护体系、依靠风控运营筑牢最后一道防线,在传播治理上将嵌入和鉴别双管齐下以防范AIGC的非法滥用。
“AI安全治理也孕育了产业全新机遇,这是一个场景刚需、快速增长的市场。”刘俊华认为,机遇之下仍要关注动态演进的AI安全风险,需要各方参与共创、坚持开源开放,加强AI安全治理生态的整体构建,更好护航产业发展。
从大模型到智能体,从内容生成到内容传播,AI安全也正在成为AI规模化应用的重要基础能力之一。此次三大AI安全解决方案的集中发布,是长三角安全人工智能安徽省实验室推进技术产品化、产业化的重要一步,未来仍将持续面向人工智能发展中的新技术、新场景和新风险,深化关键技术创新,推动AI安全能力与产业应用紧密结合,以更系统、更智能、更可落地的安全治理能力,为人工智能产业发展筑牢安全底座。