北京大学心理与认知科学学院周广玉课题组合作揭示大语言模型在健康情境判断中的污名化风险
2026/07/21
近年来,大语言模型正快速应用于医疗健康领域,被广泛用于健康咨询、疾病筛查、心理支持和辅助决策等场景。随着这些系统越来越多地参与医疗健康服务,一个值得关注的问题逐渐浮现:它们真的能够公平地对待不同健康状况的人群吗?
当直接询问“是否应该歧视某类患者”时,大语言模型通常会给出符合公平原则的回答。然而,在更贴近真实生活的具体情境中,当一个人的健康状况仅仅作为背景信息出现时,模型是否仍然能够保持公平判断?例如,在招聘、求学、求职、社交或医疗咨询等场景中,仅仅因为一个人患有HIV、乙肝或心理疾病,模型是否会产生不同的判断、建议或行为倾向?这一问题直接关系到大语言模型在医疗健康领域应用的安全性与公平性。对于正在进入公共健康和心理健康服务的大语言模型而言,这类情境判断中的污名化可能比显性歧视语言更隐蔽,也更接近真实应用中的风险。
近日,北京大学心理与认知科学学院周广玉课题组与清华大学计算机系周雨佳合作,在《自然·健康》(Nature Health)发表题为“Large Language Models Exhibit Stigmatizing Behavior in Contextual Judgements of Health Conditions”的研究论文。该研究系统考察了大语言模型在健康相关污名中的表现:一方面,模型在污名化量表上表现出较低的污名化表达;另一方面,在具体社会情境判断中,模型仍然会因个体健康状况不同而生成系统性的污名一致反应,为医疗健康场景中人工智能系统的公平性评估和治理提供了新的证据。
大语言模型健康相关污名评估框架:显性量表评估与情境判断任务
研究团队首先考察了大语言模型在显性表达中的污名化倾向。研究选取了GPT-5.1、Claude-4.5、Llama-3.3、Grok-4、DeepSeek-3.2和Qwen-3等6个主流大语言模型,围绕HIV、乙肝和心理健康三个高污名健康领域,让模型完成6套常用的健康相关污名量表,并将模型得分与既有研究中56,512名人类被试的结果进行比较。结果显示,在36组模型与量表的比较中,有34组显示模型的污名量表得分显著低于人类基准。也就是说,当问题以明确的态度量表形式出现时,大语言模型通常能够给出更符合公平、包容和非歧视原则的回答。
大语言模型和人类在显性污名量表上的得分比较
然而,研究团队发现,显性表达中的“公平”并不意味着情境判断中的“公平”。为此,研究团队设计了51个贴近现实生活的社会情境,在每个情境中,除人物健康状况外,其余信息均保持一致,以考察健康状况本身是否会影响模型判断。研究共比较了10类健康状况,并与人类被试的回答进行比较。
结果发现,仅仅改变人物的健康状况,就足以使模型产生系统性的判断差异。与健康基线相比,心理健康状况和HIV、乙肝等高污名疾病均显著增加模型产生污名一致反应的概率,而且这种差异在人类被试中也呈现出相似模式。这表明,大语言模型不仅会受到”是否患病”的影响,还会受到疾病社会污名程度的影响。
研究还发现,模型的判断会受到语言环境影响。在部分健康状况下,中文输入比英文输入更容易产生污名一致反应,说明模型公平性并非固定属性,而会受到语言和文化语境共同影响。
为探索缓解方法,研究团队比较了非推理模型与推理模型,并进一步从推理过程中总结出一系列能够减少污名化输出的策略。研究发现,无论采用推理模型还是加入相应策略提示,都能够在一定程度上降低模型产生污名一致反应的概率。
大语言模型在不同健康状况、语言、模型和情境中的污名一致反应
该研究首次系统揭示了大语言模型在健康相关污名中的“显性表达—情境判断”分离现象,将健康公平性评估的重点从“模型是否会说出歧视性语言”,推进到“模型是否会在真实情境中作出公平判断”。研究团队指出,未来面向医疗健康的大语言模型,应增加更贴近真实应用场景的情境化公平性审计,并区分合理医学谨慎与无依据的污名化推断,为健康人工智能的安全部署提供科学依据。
本研究第一作者为北京大学心理与认知科学学院2024级博士生王曦。周雨佳和周广玉为共同通讯作者。研究得到国家社会科学基金和国家自然科学基金的支持。
文章来源北京大学,分享只为学术交流,如涉及侵权问题请联系我们,我们将及时修改或删除。
-
2026年10月优质国际学术会议推荐 280
-
第五届传感、测量、通信与物联网技术国 435
-
2026年第15届计算与模式识别国际 690
-
2026年计算科学与学习技术前沿国际 519
-
2026年第三届计算机网络与云计算国 2966
-
2026资源、化学化工与应用材料国际 4066
-
2026年图像处理与数字创意设计国际 3769
-
2026年机械工程,新能源与电气技术 8771
-
2026年材料科学、低碳技术与动力工 4236
-
2026年文化产业管理、创意经济与城 09-16
-
2026年统计建模、数据分析与机器学 09-16
-
2026年机械工程、结构动力学与智能 09-16
-
2026年数字金融、区块链技术与产业 09-16
-
2026年计算机视觉与工业图像检测国 09-16
-
2026年桥隧建设、地下工程与岩土力 09-16
-
2026 JCR影响因子正式发布1932
-
中国科协发布2025年《重要学术2007
-
2026年新锐分区(原中科院期刊10469
-
2025年两院院士增选有效候选人6502
-
好学术:科研网址导航|学术头条分9003
-
2025年国际期刊预警名单发布!8859
-
2025年中科院期刊分区表重磅发30088
-
吉林大学校长张希:学术会议中的提9934
-
科研人员构建人造光合水凝胶微球09-16
-
科研人员构建bridge RNA09-16
-
海洋热浪生态效应研究取得进展09-16
-
科研人员提出机器学习辅助的“材料09-16
-
研究揭示芭蕉科染色体演化机制与花09-16
-
科研人员研发混合集成气体传感芯片09-16
-
西安交大孟令杰/党东锋团队联合 09-16
-
北京交通大学经济管理学院 21716

-
环球科研协会(GSRA) 24776

-
中国能源学会 24879

-
中国能源学会 2674

-
济南大学管理学院 21669

-
农民权益保护与区域发展研究中心 2759

-
中国人力资源开发杂志 23675

-
北京东方华光文化交流有限公司 2506

-
阜阳师范学院 2600

-
北京爱德迈德广告有限公司 26115

-
中国抗癌协会肿瘤标志专委会 8520

-
河南中医药大学 21815

-
巴塞尔公约亚太地区协调中心 24982

-
北京艾尚国际展览有限公司 8876

-
北京贝拓会展服务有限公司 18674

-
西安绿地笔克国际会展中心 23823

-
WILL 24758

-
北京科萃人机环境系统工程技术研究 8648

-
厦门薪源会展服务有限公司 18553

-
广州健世医疗器械有限公司 2707





















138










































