中国农业大学信电学院智能与系统安全实验室在人工智能安全领域研究取得重要进展
2026/01/08
近日,信息与电气工程学院智能与系统安全实验室研究论文《基于方向映射和对抗蒸馏的后门防御方法》(BeDKD: Backdoor Defense Based on Directional Mapping Module and Adversarial Knowledge Distillation)被人工智能领域顶级会议AAAI-2026(The 40th Annual AAAI Conference on Artificial Intelligence,CCF-A类会议论文)接收为主会Poster论文。
BeDKD方法架构图
随着深度神经网络在自然语言处理任务中的广泛应用,后门攻击已成为威胁模型安全的重要隐患。攻击者将隐蔽的触发模式植入少量数据中制作中毒的训练集。当模型正常训练后即自动植入特定模式的后门,使模型在面对特定输入时输出攻击者制定的回答,严重威胁智能系统的可信部署。现有的后门防御依赖大量干净数据来削弱后门,但通常难以处理残留的触发器效应,导致攻击成功率(ASR)持续偏高。因此,在实现后门防御与保持模型性能之间取得令人满意的平衡仍然是一个重大挑战。为解决上述问题,我们提出了一种基于动态知识蒸馏与定向映射调制器的后门防御框架,该方法仅需少量干净数据即可高效检测部分中毒数据,并在保持模型原有性能的同时,显著降低后门攻击成功率。
该论文第一作者为信电学院-智能与系统安全实验室2024级博士研究生吴政娴,文娟副教授和彭万里副教授为论文的通讯作者,实验室薛一鸣教授参与指导。论文成果受到国家自然科学基金项目(No.62272463、No.62402117)的资助,本研究工作得到中国农业大学校级高性能计算平台支持。
文章来源中国农业大学,分享只为学术交流,如涉及侵权问题请联系我们,我们将及时修改或删除。
-
2026资源、化学化工与应用材料国际 218
-
2026年智能制造与光学传感技术国际 235
-
2026年2月高录用率国际学术会议列 37
-
2026年第六届土木工程与建筑国际会 841
-
2026年图像处理与数字创意设计国际 90
-
2026年机械工程,新能源与电气技术 4589
-
2026年材料科学、低碳技术与动力工 307
-
2026年第二届无线与光通信国际会议 1149
-
2026 9th Internati 01-15
-
2026年土木工程智能建造与基础设施 01-15
-
2026年环境工程、生态修复与可持续 01-15
-
2026年数字健康、远程医疗与智能诊 01-15
-
2026年金融科技、智能风控与数字资 01-15
-
2026年智慧农业、食品工程与供应链 01-15
-
2026年计算建模、数学与大数据国际 01-15
-
2025年两院院士增选有效候选人2854
-
2025最新JCR分区及影响因子7970
-
好学术:科研网址导航|学术头条分3741
-
2025年国际期刊预警名单发布!3763
-
2025年中科院期刊分区表重磅发13927
-
中国科协《重要学术会议目录(208283
-
吉林大学校长张希:学术会议中的提4800
-
清华大学物理系徐勇、段文晖研究组12-25
-
清华大学-上汽通用五菱汽车人工智12-25
-
参加学术会议学术蝗虫_参加学术会12-25
-
参加学术会议图片_参加学术会议需12-25
-
参加学术会议投稿邮件_参加学术会12-25
-
参加学术会议文学_参加学术会议有12-25
-
参加学术会议文案_参加学术会议文12-25
-
参加学术会议违法_参加学术会议违12-25
-
南方电网深圳供电局 2173

-
中国演示版学会 24076

-
复旦大学附属眼耳鼻喉科医院 8205

-
科严文化 2172

-
山东大学文学与新闻传播学院 24200

-
湖北省武汉大学 18208

-
APC 23497

-
北京富强康乐健康医学研究院 24135

-
北京艾尚国际展览有限公司 8214

-
MHT 8423

-
HKSME 24120

-
华南出版社(广东)有限公司 8487

-
汕头大学 8170

-
山西和邦商贸有限公司 8147

-
北京师范大学 18275

-
西北工业大学 18436

-
湖北经济学院 23316

-
北京优合信网络技术有限公司 8146

-
CECSF 23455

-
武汉金钥匙会务服务有限公司 21247

















26













































