当前位置:首页 >> 学术资讯 >> 科研信息

北京大学心理与认知科学学院周广玉课题组合作揭示大语言模型在健康情境判断中的污名化风险

2026/07/21

文章导读
大语言模型正被广泛用于医疗健康咨询,但一项发表于《自然·健康》的最新研究揭示了一个令人不安的悖论:它们在显性量表上表现得比人类更“公平”,然而在招聘、求职、社交等具体情境中,仅仅因人物患有HIV、乙肝或心理疾病,就会产生系统性污名化判断。更值得警惕的是,这种“显性公平、情境歧视”的分离现象在中文环境下比英文更为突出。当AI的健康判断在真实场景中悄然偏离公正,我们该如何确保其安全部署?
— 内容由好学术AI分析文章内容生成,仅供参考。

近年来,大语言模型正快速应用于医疗健康领域,被广泛用于健康咨询、疾病筛查、心理支持和辅助决策等场景。随着这些系统越来越多地参与医疗健康服务,一个值得关注的问题逐渐浮现:它们真的能够公平地对待不同健康状况的人群吗?

当直接询问“是否应该歧视某类患者”时,大语言模型通常会给出符合公平原则的回答。然而,在更贴近真实生活的具体情境中,当一个人的健康状况仅仅作为背景信息出现时,模型是否仍然能够保持公平判断?例如,在招聘、求学、求职、社交或医疗咨询等场景中,仅仅因为一个人患有HIV、乙肝或心理疾病,模型是否会产生不同的判断、建议或行为倾向?这一问题直接关系到大语言模型在医疗健康领域应用的安全性与公平性。对于正在进入公共健康和心理健康服务的大语言模型而言,这类情境判断中的污名化可能比显性歧视语言更隐蔽,也更接近真实应用中的风险。

近日,北京大学心理与认知科学学院周广玉课题组与清华大学计算机系周雨佳合作,在《自然·健康》(Nature Health)发表题为“Large Language Models Exhibit Stigmatizing Behavior in Contextual Judgements of Health Conditions”的研究论文。该研究系统考察了大语言模型在健康相关污名中的表现:一方面,模型在污名化量表上表现出较低的污名化表达;另一方面,在具体社会情境判断中,模型仍然会因个体健康状况不同而生成系统性的污名一致反应,为医疗健康场景中人工智能系统的公平性评估和治理提供了新的证据。

北京大学心理与认知科学学院周广玉课题组合作揭示大语言模型在健康情境判断中的污名化风险

大语言模型健康相关污名评估框架:显性量表评估与情境判断任务

研究团队首先考察了大语言模型在显性表达中的污名化倾向。研究选取了GPT-5.1、Claude-4.5、Llama-3.3、Grok-4、DeepSeek-3.2和Qwen-3等6个主流大语言模型,围绕HIV、乙肝和心理健康三个高污名健康领域,让模型完成6套常用的健康相关污名量表,并将模型得分与既有研究中56,512名人类被试的结果进行比较。结果显示,在36组模型与量表的比较中,有34组显示模型的污名量表得分显著低于人类基准。也就是说,当问题以明确的态度量表形式出现时,大语言模型通常能够给出更符合公平、包容和非歧视原则的回答。

北京大学心理与认知科学学院周广玉课题组合作揭示大语言模型在健康情境判断中的污名化风险

大语言模型和人类在显性污名量表上的得分比较

然而,研究团队发现,显性表达中的“公平”并不意味着情境判断中的“公平”。为此,研究团队设计了51个贴近现实生活的社会情境,在每个情境中,除人物健康状况外,其余信息均保持一致,以考察健康状况本身是否会影响模型判断。研究共比较了10类健康状况,并与人类被试的回答进行比较。

结果发现,仅仅改变人物的健康状况,就足以使模型产生系统性的判断差异。与健康基线相比,心理健康状况和HIV、乙肝等高污名疾病均显著增加模型产生污名一致反应的概率,而且这种差异在人类被试中也呈现出相似模式。这表明,大语言模型不仅会受到”是否患病”的影响,还会受到疾病社会污名程度的影响。

研究还发现,模型的判断会受到语言环境影响。在部分健康状况下,中文输入比英文输入更容易产生污名一致反应,说明模型公平性并非固定属性,而会受到语言和文化语境共同影响。

为探索缓解方法,研究团队比较了非推理模型与推理模型,并进一步从推理过程中总结出一系列能够减少污名化输出的策略。研究发现,无论采用推理模型还是加入相应策略提示,都能够在一定程度上降低模型产生污名一致反应的概率。

北京大学心理与认知科学学院周广玉课题组合作揭示大语言模型在健康情境判断中的污名化风险

大语言模型在不同健康状况、语言、模型和情境中的污名一致反应

该研究首次系统揭示了大语言模型在健康相关污名中的“显性表达—情境判断”分离现象,将健康公平性评估的重点从“模型是否会说出歧视性语言”,推进到“模型是否会在真实情境中作出公平判断”。研究团队指出,未来面向医疗健康的大语言模型,应增加更贴近真实应用场景的情境化公平性审计,并区分合理医学谨慎与无依据的污名化推断,为健康人工智能的安全部署提供科学依据。

本研究第一作者为北京大学心理与认知科学学院2024级博士生王曦。周雨佳和周广玉为共同通讯作者。研究得到国家社会科学基金和国家自然科学基金的支持。




版权声明:
文章来源北京大学,分享只为学术交流,如涉及侵权问题请联系我们,我们将及时修改或删除。

相关学术资讯
近期会议

2026年第9届信息系统与计算机辅助教育国际会议(ICISCAE 2026)(2026-09-27)

2026年艺术设计与视觉表达国际会议(AEVD 2026)(2026-09-28)

2026年第五届算法、数据挖掘和信息技术国际会议(ADMIT 2026)(2026-10-16)

2026年人工智能与机器人系统国际会议(ICAIRS 2026)(2026-10-23)

2026年第三届先进机器人, 自动化工程与机器学习国际会议(ARAEML 2026)(2026-10-23)

2026年国际可再生、可持续能源和智能技术会议(2026-10-30)

2026年人工智能、大数据与云计算国际会议 (AIBDCC 2026)(2026-10-30)

2026年土木水利材料与高性能结构国际会议 (CHMHS 2026)(2026-10-30)

2026年智能科学与信息物理技术国际学术会议(ISCPT 2026)(2026-10-30)

2026年电力、电气和能源系统工程国际会议 (PEESE 2026)(2026-10-31)

2026先进材料、能源环境与机械制造国际学术会议(ICAMEEMM 2026)(2026-9-26)

2027年第10届先进能源材料国际会议(ICAEM 2027)(2027-1-23)

第八届测绘与地理信息国际研讨会(CSG 2027)(2027-5-31)

2026系统科学、行为建模与计算仿真国际会议(ICSBMCS 2026)(2026-9-20)

2026年防灾减灾、灾害预警与应急管理国际会议(ICDPRDWEM 2026)(2026-9-25)

2026年金属材料、物理与化学国际会议(ICMMPC 2026)(2026-9-27)

2026年智能物联网、智慧交通与大数据国际会议(IITIT 2026)(2026-9-3)

2026电子信息、计算机通信与信号处理国际会议(EICCSP 2026)(2026-9-29)

2026年综合能源、工业可靠性与工业AI国际会议(ICIEIRI 2026)(2026-9-30)

2026年计算机应用、网络计算与智能交互系统国际会议(ICANS 2026)(2026-9-18)

小贴士:学术会议云是学术会议查询检索的第三方门户网站。它是会议组织发布会议信息、众多学术爱好者参加会议、找会议的双向交流平台。它可提供国内外学术会议信息预报、分类检索、在线报名、论文征集、资料发布以及了解学术资讯,查找会服机构等服务,支持PC、微信、APP,三媒联动。