我校学者在顶级会议发表大模型安全评测研究成果
时间:2026-07-30 来源:科学技术处 发布:科技处 点击:3421
近日,人工智能学院裴今声教授团队在大模型安全评测方向的论文被国际安全顶级会议接收并作大会报告。论文提出了面向越狱攻击的鲁棒性评测框架,首次系统刻画了对齐漂移现象,为安全对齐提供了新的度量工具。
该工作由我校与东江大学合作完成,我校为第一完成单位。

近日,人工智能学院裴今声教授团队在大模型安全评测方向的论文被国际安全顶级会议接收并作大会报告。论文提出了面向越狱攻击的鲁棒性评测框架,首次系统刻画了对齐漂移现象,为安全对齐提供了新的度量工具。
该工作由我校与东江大学合作完成,我校为第一完成单位。