2025年6月16日下午,由广州大学网络空间安全学院名誉院长、中国工程院方滨兴院士作为项目负责人的中国工程院战略研究与咨询重点项目《国家级大模型监管保险箍模式研究》开题研讨会在广州大学黄埔校区博学楼成功举办。广州大学田志宏副校长主持会议并致欢迎词。

图1 田志宏副校长主持会议并致欢迎词
出席本次会议的参会嘉宾有中国工程院丁文华院士、鹏城实验室贾焰教授、暨南大学黄欣沂教授、广东工业大学周郭许教授、华南师范大学赵淦森教授、华南理工大学蔡宏民教授、广东金融学院副校长黄琼教授和中国工程院一局信息与电子工程学部办公室二级调研员张燕等。

图2 齐佳音教授做开题汇报
研讨会上,广州大学网络空间安全学院齐佳音教授代表项目组汇报了《国家级大模型监管保险箍模式研究》项目的主要内容。项目围绕当下大模型监管中的三个重要难点问题展开,即,如何通过数据驱动来更为客观地实现大模型风险的分类分级、如何高效低成本地实现大模型的安全监管以及如何实现大模型应用安全的全程审计和溯源。针对第一个问题,项目将以人工智能应用风险事故数据库为数据来源,构建事故事件风险卡数据库,通过风险卡数据库来动态研判大模型风险分类分级;针对问题二,项目将在考虑多模态内容安全检测以及大模型、Agent、工具组件等大模型复杂应用链的情形下,设计一套国家级的大模型安全风险监测的保险箍方案;针对问题三,项目组将研究基于身份认证、可信交互、区块链技术等的人工智能应用监管溯源审计方案,以实现大模型应用安全的全程审计和溯源。
专家组组长、中国工程院丁文华院士对项目表示认可,认为项目的研究体系化良好且基础扎实,但也指出这一研究存在很大难度。例如,在大量 AI 应用场景和模型迭代中能否实现完全溯源,希望项目组在后续研究中深入研究,提出可操作性的具体方案。专家组的其他专家学者也对项目设计提出了进一步完善的具体建议。

图3 与会专家对项目进行指导

图4 项目负责人、中国工程院方滨兴院士
项目负责人方滨兴院士做了总结发言,他对人工智能行为体(如机器人)的潜在风险,如失控伤人、拒绝重启和集体交互等风险深表担忧。他指出人工智能虽无创新能力,但整合全球人类知识成果后能力惊人,可能对人类构成威胁。因此,国家要加快制定相关规范标准,建立人工智能产品的市场准入制度和安全保障机制。
本次项目启动会为项目执行指明了攻关方向,后期项目组将认真研究,进一步完善研究设计,将项目研究任务的执行落实好,为国家在人工智能安全治理政策方面提供高质量决策咨询服务。