长三角安全人工智能安徽省实验室发布星界、星驭、星鉴三大 AI 安全方案
一家省级 AI 安全实验室把大模型内容安全、智能体安全和 AIGC 内容溯源打包成三款产品并公开落地数据,是观察国内 AI 安全治理怎么从研究走向工程化的样本。
9月19日,第一届中国网络空间安全大会(CCSC 2026)的人工智能安全与应用治理论坛在合肥举办。承办方之一长三角安全人工智能安徽省实验室发布三款 AI 安全治理方案:面向大模型内容安全的星界、面向智能体应用安全的星驭,以及面向 AIGC 内容可信传播的星鉴。实验室主任刘俊华介绍了 AI 安全治理的技术进展与落地实践。
正文摘录
9月19日,第一届中国网络空间安全大会(CCSC 2026)的高水平专题论坛——人工智能安全与应用治理论坛在安徽合肥正式举办。作为承办方之一,长三角安全人工智能安徽省实验室在现场发布了三大 AI 安全解决方案星界、星驭、星鉴,覆盖大模型内容安全、智能体应用安全与 AIGC 生成内容传播可信;实验室主任刘俊华发表《AI 安全治理技术进展与应用实践》主题演讲,分享了长三角安全人工智能安徽省实验室在 AI 安全领域的最新技术进展和产业实践。 当前,AI 技术的阶跃与产业应用的拓展正在加速,随之而来的安全问题也日益严峻,影响和制约了 AI 的进一步发展。 长三角安全人工智能实验室作为由安徽省人民政府批准,依托安徽星盾智能科技有限公司建设的高能级科创平台,致力于构建人工智能安全治理和防护能力,护航人工智能技术和产业发展,已收获多项 AI 安全领域的权威奖项、认证和评测竞赛冠军。实验室面向 AI 安全治理关键挑战攻关,持续构建并完善 AI 安全治理和防护产品体系。 论坛现场,中国工程院院士吴世忠,科大讯飞联合创始人、技术委员会主任胡国平,中国科学技术大学教授、长三角安全人工智能安徽省实验室首席科学家俞能海,长三角安全人工智能安徽省实验室主任刘俊华共同上台,正式发布面向 AI 安全治理的三大方案:大模型内容安全治理解决方案“星界”、智能体应用安全解决方案“星驭”、AIGC 内容可信传播治理方案“星鉴”。 星界面向大模型全生命周期,提供覆盖数据构建、模型训练、应用上线与持续运营的一体化内容安全治理能力。从源头通过训练数据清洗、安全价值对齐与模型安全增强,降低内生风险;应用运行中通过内容安全护栏,实时识别与处置提示词攻击、违法违规内容等风险;持续运营中通过风险监测与人工研判发现问题、快速干预与闭环优化。同时安全评测会贯穿全过程,持续验证和驱动安全能力提升。