← 返回新闻列表
量子位 🗓️ 2026-09-21

刚刚,长三角安全人工智能安徽省实验室发布星界、星驭、星鉴三大AI安全解决方案

⚡ 一句话看懂:9月19日,第一届中国网络空间安全大会(CCSC 2026)的高水平专题论坛在安徽合肥正式举办。

长三角安全人工智能安徽省实验室发布星界、星驭、星鉴三大AI安全解决方案 9月19日,第一届中国网络空间安全大会(CCSC 2026)的高水平专题论坛在安徽合肥正式举办。

9月19日,第一届中国网络空间安全大会(CCSC 2026)的高水平专题论坛——人工智能安全与应用治理论坛在安徽合肥正式举办。

作为承办方之一,长三角安全人工智能安徽省实验室在现场发布了三大AI安全解决方案星界、星驭、星鉴,覆盖大模型内容安全、智能体应用安全与AIGC生成内容传播可信;实验室主任刘俊华发表《AI安全治理技术进展与应用实践》主题演讲,分享了长三角安全人工智能安徽省实验室在AI安全领域的最新技术进展和产业实践。

三大方案发布,构建AI安全治理全链路能力 当前,AI技术的阶跃与产业应用的拓展正在加速,随之而来的安全问题也日益严峻,影响和制约了AI的进一步发展。

长三角安全人工智能实验室作为由安徽省人民政府批准,依托安徽星盾智能科技有限公司建设的高能级科创平台,致力于构建人工智能安全治理和防护能力,护航人工智能技术和产业发展,已收获多项AI安全领域的权威奖项、认证和评测竞赛冠军。

实验室面向AI安全治理关键挑战攻关,持续构建并完善AI安全治理和防护产品体系。

论坛现场,中国工程院院士吴世忠,科大讯飞联合创始人、技术委员会主任胡国平,中国科学技术大学教授、长三角安全人工智能安徽省实验室首席科学家俞能海,长三角安全人工智能安徽省实验室主任刘俊华共同上台,正式发布面向AI安全治理的三大方案:大模型内容安全治理解决方案“星界”、智能体应用安全解决方案“星驭”、AIGC内容可信传播治理方案“星鉴”。

星界面向大模型全生命周期,提供覆盖数据构建、模型训练、应用上线与持续运营的一体化内容安全治理能力。

从源头通过训练数据清洗、安全价值对齐与模型安全增强,降低内生风险;应用运行中通过内容安全护栏,实时识别与处置提示词攻击、违法违规内容等风险;持续运营中通过风险监测与人工研判发现问题、快速干预与闭环优化。

同时安全评测会贯穿全过程,持续验证和驱动安全能力提升。

星界可适用于教育、医疗、汽车等行业的大模型应用,覆盖模型研发与上线评估、运行防护及持续运营,支持开源与闭源模型,兼容云端及私有化部署,满足差异化内容安全治理需求。

星驭面向各类智能体应用,构建覆盖全生命周期的攻防一体化安全治理方案。

方案以身份与权限管理为底座,可明确智能体执行主体、授权关系与操作边界;上线前通过Skill安全检测识别供应链风险,并在安全靶场中通过自动化红队测试验证真实执行风险;运行中覆盖“输入—规划—执行”全过程,对提示词注入、工具滥用、越权操作、敏感信息泄露及任务失控等风险进行监测与分级处置;事后通过日志回放与全链路审计支撑复盘溯源,保障智能体安全运行并兼顾业务可用性。

🔗 原始来源

如果你要核对细节,可以再看原文: 量子位原文链接