中国农业大学信电学院智能与系统安全实验室在人工智能安全领域研究取得重要进展
2026/01/08
近日,信息与电气工程学院智能与系统安全实验室研究论文《基于方向映射和对抗蒸馏的后门防御方法》(BeDKD: Backdoor Defense Based on Directional Mapping Module and Adversarial Knowledge Distillation)被人工智能领域顶级会议AAAI-2026(The 40th Annual AAAI Conference on Artificial Intelligence,CCF-A类会议论文)接收为主会Poster论文。
BeDKD方法架构图
随着深度神经网络在自然语言处理任务中的广泛应用,后门攻击已成为威胁模型安全的重要隐患。攻击者将隐蔽的触发模式植入少量数据中制作中毒的训练集。当模型正常训练后即自动植入特定模式的后门,使模型在面对特定输入时输出攻击者制定的回答,严重威胁智能系统的可信部署。现有的后门防御依赖大量干净数据来削弱后门,但通常难以处理残留的触发器效应,导致攻击成功率(ASR)持续偏高。因此,在实现后门防御与保持模型性能之间取得令人满意的平衡仍然是一个重大挑战。为解决上述问题,我们提出了一种基于动态知识蒸馏与定向映射调制器的后门防御框架,该方法仅需少量干净数据即可高效检测部分中毒数据,并在保持模型原有性能的同时,显著降低后门攻击成功率。
该论文第一作者为信电学院-智能与系统安全实验室2024级博士研究生吴政娴,文娟副教授和彭万里副教授为论文的通讯作者,实验室薛一鸣教授参与指导。论文成果受到国家自然科学基金项目(No.62272463、No.62402117)的资助,本研究工作得到中国农业大学校级高性能计算平台支持。
文章来源中国农业大学,分享只为学术交流,如涉及侵权问题请联系我们,我们将及时修改或删除。
-
第五届传感、测量、通信与物联网技术国 42
-
2026年9月优质国际学术会议推荐 263
-
2026年第15届计算与模式识别国际 212
-
2026年第二届计算机视觉与机器学习 2124
-
2026年无人机遥感与人工智能国际会 472
-
2026资源、化学化工与应用材料国际 3740
-
2026年图像处理与数字创意设计国际 3525
-
2026年机械工程,新能源与电气技术 8084
-
2026年材料科学、低碳技术与动力工 3712
-
第三届国际会议语言学、心理学与创意教 08-07
-
2026年建筑科学、材料工程与可持续 08-07
-
2026年国际会议金融科技、市场营销 08-07
-
第三届国际社会科学与文化研究会议平行 08-07
-
ICSSCS 2026 - 子论坛: 08-07
-
第三届社会科学与文化研究国际会议平行 08-07
-
2026 JCR影响因子正式发布1135
-
中国科协发布2025年《重要学术1583
-
2026年新锐分区(原中科院期刊8243
-
2025年两院院士增选有效候选人6001
-
好学术:科研网址导航|学术头条分7917
-
2025年国际期刊预警名单发布!8062
-
2025年中科院期刊分区表重磅发28351
-
吉林大学校长张希:学术会议中的提9122
-
清华大学计算机系高性能所获得IE07-31
-
北京大学生命科学学院伊成器课题组07-31
-
北京大学罗欢、李阿明、方方课题组07-31
-
北京大学生命科学学院郭强团队与合07-31
-
清华大学集成电路学院任天令团队合07-31
-
清华大学5位清华人当选“202607-31
-
研究揭示热带雨林优势树种望天树幼07-31
-
运动心理学分会 18661

-
云南中国国际旅行社 23517

-
中国学术会议 19053

-
宁波卓亨会展有限公司 18469

-
中山大学管理学院 18661

-
中国矿业大学电气与动力工程学院 23526

-
广州市锐博生物科技有限公司 2573

-
华中科技大学 18824

-
武汉大学 计算机学院 23725

-
大连乐百年有限公司 18676

-
中国连锁经营协会 21603

-
湖南长沙国防科技大学计算机学院微 19475

-
中科成创(北京)生物技术有限公司 8447

-
国家会议中心 21943

-
中国高科技产业化研究会 24635

-
上海麦峰医学科技有限公司 8479

-
哈尔滨医科大学 3054

-
国泰安金融学院 21432

-
广州奥格尔展览有限公司 8579

-
杨浦区四平路总工会 18713





















175








































