8月28日上午,应我院邀请,新加坡科技研究局(A*STAR)前沿人工智能研究中心(CFAR)高级科学家甄亮利博士到校作题为《从感知到生成:视觉模型与大语言模型的可靠性与安全性》的学术报告。报告会由我院国家级青年人才王炎特聘研究员主持,学校相关专业师生参会交流。

报告中,甄亮利博士系统介绍了团队近年在视觉模型、大语言模型两个层面的研究工作。他以自动驾驶感知场景为例,讲解物理世界对抗样本构造方法、防御手段以及视觉模型脆弱性的系统化评估;针对大语言模型,重点介绍越狱攻击、幻觉两大核心风险,分享结构化语义伪装攻击方法、基于不确定性度量与知识溯源的幻觉检测抑制方法以及可落地的防护机制,最后对比探讨“感知”与“生成”两类模型安全问题的共性与差异,对可信人工智能评测体系与治理实践作出展望。

互动环节中,现场师生展开充分交流探讨。甄亮利博士对大家提出的问题逐一细致解答,并分享宝贵的科研经验与独到的学术见解,现场学术氛围热烈融洽。
报告人简介:
甄亮利,新加坡科技研究局(A*STAR)前沿人工智能研究中心(CFAR)高级科学家,IEEE 高级会员。主要研究方向为安全可信人工智能与多目标优化。作为项目负责人或共同负责人,参与多项新加坡国家重点研发项目。在 IEEE TPAMI、TIFS、TIP、TNNLS 等国际期刊及 CVPR、ICCV、ICLR、ICML 等学术会议上发表论文 60 余篇,Google Scholar 被引用 3000 余次。现任《IEEE Transactions on Neural Networks and Learning Systems》期刊副编辑。曾获 IJCAI 2024 基于视觉的远程生理信号感知挑战赛冠军、2025 年全球大语言模型安全挑战赛第三名。