当前位置:首页 >> 学术资讯 >> 科研信息

北京大学心理与认知科学学院周广玉课题组合作揭示大语言模型在健康情境判断中的污名化风险

2026/07/21

文章导读
大语言模型正被广泛用于医疗健康咨询,但一项发表于《自然·健康》的最新研究揭示了一个令人不安的悖论:它们在显性量表上表现得比人类更“公平”,然而在招聘、求职、社交等具体情境中,仅仅因人物患有HIV、乙肝或心理疾病,就会产生系统性污名化判断。更值得警惕的是,这种“显性公平、情境歧视”的分离现象在中文环境下比英文更为突出。当AI的健康判断在真实场景中悄然偏离公正,我们该如何确保其安全部署?
— 内容由好学术AI分析文章内容生成,仅供参考。

近年来,大语言模型正快速应用于医疗健康领域,被广泛用于健康咨询、疾病筛查、心理支持和辅助决策等场景。随着这些系统越来越多地参与医疗健康服务,一个值得关注的问题逐渐浮现:它们真的能够公平地对待不同健康状况的人群吗?

当直接询问“是否应该歧视某类患者”时,大语言模型通常会给出符合公平原则的回答。然而,在更贴近真实生活的具体情境中,当一个人的健康状况仅仅作为背景信息出现时,模型是否仍然能够保持公平判断?例如,在招聘、求学、求职、社交或医疗咨询等场景中,仅仅因为一个人患有HIV、乙肝或心理疾病,模型是否会产生不同的判断、建议或行为倾向?这一问题直接关系到大语言模型在医疗健康领域应用的安全性与公平性。对于正在进入公共健康和心理健康服务的大语言模型而言,这类情境判断中的污名化可能比显性歧视语言更隐蔽,也更接近真实应用中的风险。

近日,北京大学心理与认知科学学院周广玉课题组与清华大学计算机系周雨佳合作,在《自然·健康》(Nature Health)发表题为“Large Language Models Exhibit Stigmatizing Behavior in Contextual Judgements of Health Conditions”的研究论文。该研究系统考察了大语言模型在健康相关污名中的表现:一方面,模型在污名化量表上表现出较低的污名化表达;另一方面,在具体社会情境判断中,模型仍然会因个体健康状况不同而生成系统性的污名一致反应,为医疗健康场景中人工智能系统的公平性评估和治理提供了新的证据。

北京大学心理与认知科学学院周广玉课题组合作揭示大语言模型在健康情境判断中的污名化风险

大语言模型健康相关污名评估框架:显性量表评估与情境判断任务

研究团队首先考察了大语言模型在显性表达中的污名化倾向。研究选取了GPT-5.1、Claude-4.5、Llama-3.3、Grok-4、DeepSeek-3.2和Qwen-3等6个主流大语言模型,围绕HIV、乙肝和心理健康三个高污名健康领域,让模型完成6套常用的健康相关污名量表,并将模型得分与既有研究中56,512名人类被试的结果进行比较。结果显示,在36组模型与量表的比较中,有34组显示模型的污名量表得分显著低于人类基准。也就是说,当问题以明确的态度量表形式出现时,大语言模型通常能够给出更符合公平、包容和非歧视原则的回答。

北京大学心理与认知科学学院周广玉课题组合作揭示大语言模型在健康情境判断中的污名化风险

大语言模型和人类在显性污名量表上的得分比较

然而,研究团队发现,显性表达中的“公平”并不意味着情境判断中的“公平”。为此,研究团队设计了51个贴近现实生活的社会情境,在每个情境中,除人物健康状况外,其余信息均保持一致,以考察健康状况本身是否会影响模型判断。研究共比较了10类健康状况,并与人类被试的回答进行比较。

结果发现,仅仅改变人物的健康状况,就足以使模型产生系统性的判断差异。与健康基线相比,心理健康状况和HIV、乙肝等高污名疾病均显著增加模型产生污名一致反应的概率,而且这种差异在人类被试中也呈现出相似模式。这表明,大语言模型不仅会受到”是否患病”的影响,还会受到疾病社会污名程度的影响。

研究还发现,模型的判断会受到语言环境影响。在部分健康状况下,中文输入比英文输入更容易产生污名一致反应,说明模型公平性并非固定属性,而会受到语言和文化语境共同影响。

为探索缓解方法,研究团队比较了非推理模型与推理模型,并进一步从推理过程中总结出一系列能够减少污名化输出的策略。研究发现,无论采用推理模型还是加入相应策略提示,都能够在一定程度上降低模型产生污名一致反应的概率。

北京大学心理与认知科学学院周广玉课题组合作揭示大语言模型在健康情境判断中的污名化风险

大语言模型在不同健康状况、语言、模型和情境中的污名一致反应

该研究首次系统揭示了大语言模型在健康相关污名中的“显性表达—情境判断”分离现象,将健康公平性评估的重点从“模型是否会说出歧视性语言”,推进到“模型是否会在真实情境中作出公平判断”。研究团队指出,未来面向医疗健康的大语言模型,应增加更贴近真实应用场景的情境化公平性审计,并区分合理医学谨慎与无依据的污名化推断,为健康人工智能的安全部署提供科学依据。

本研究第一作者为北京大学心理与认知科学学院2024级博士生王曦。周雨佳和周广玉为共同通讯作者。研究得到国家社会科学基金和国家自然科学基金的支持。




版权声明:
文章来源北京大学,分享只为学术交流,如涉及侵权问题请联系我们,我们将及时修改或删除。

相关学术资讯
近期会议

第六届互联网技术与教育信息化国际学术会议 (ITEI 2026)(2026-07-24)

第五届航空航天工程与系统国际研讨会(ISAES 2026)(2026-07-24)

第十届教育、管理与社会科学国际学术会议 (ISEMSS 2026)(2026-07-24)

第六届电气工程与机电一体化技术国际学术会议(ICEEMT 2026)(2026-07-24)

第五届能源与电力系统国际学术会议 (ICEEPS 2026)(2026-07-24)

2026年第二届光学工程与传感仪器国际学术会议(2026-07-31)

第九届声学、振动、噪声控制国际研讨会(CAVNC 2026)(2026-08-07)

第六届能源演进与电力工程大会:转型·智能·自治(EEPE-TIA 2026)(2026-08-07)

2026年智能医学与图像计算国际会议 (IMIC 2026)(2026-08-21)

2026年机械动力学、振动控制与噪声工程国际会议(ICMDVCNE 2026)(2026-08-22)

2026年超级电容器、能源存储与混合储能系统国际学术会议(ESSHE 2026)(2026-8-17)

2026医学、生物技术与医疗健康国际会议(ICMBH 2026)(2026-8-28)

2026年社会心理学、行为科学与教育国际会议(SPBSE 2026)(2026-9-7)

2026数学、计算建模与先进算法国际会议(ICMCMAA 2026)(2026-8-18)

2026年现代化教育与人文学科国际会议(ICMEH 2026)(2026-8-25)

2026年土木建筑、水利与工程管理国际会议(ICCEWREM 2026)(2026-8-30)

2026年生态经济与环境科学国际会议(ICEEES 2026)(2026-8-15)

2026年载运工具、动力工程与交通运输国际会议(VEPET 2026)(2026-9-12)

2026年绿色技术、生态恢复与环境监测国际会议(GTEREM 2026)(2026-8-16)

2026年新闻学、传播学与新媒体技术国际学术会议(JCNMT 2026)(2026-8-10)

小贴士:学术会议云是学术会议查询检索的第三方门户网站。它是会议组织发布会议信息、众多学术爱好者参加会议、找会议的双向交流平台。它可提供国内外学术会议信息预报、分类检索、在线报名、论文征集、资料发布以及了解学术资讯,查找会服机构等服务,支持PC、微信、APP,三媒联动。
综合推荐区

AI+大数据算法 智能精准匹配期刊投稿

第五届先进制造技术与制造系统国际学术会议(I.

第七届经济管理与大数据应用国际 学术会议(I.

第二届航空航天、信息技术与控制工程国际学术会.

第七届心理健康与教育、人文发展国际学术会议(.

2026年智能医学和图像计算国际会议(IMI.

第六届光学成像与图像处理国际学术会议 (IC.

2026年第七届控制, 机器人与智能系统国际.

第六届电子信息工程与计算机技术国际学术会议(.

2026年智能机器人与控制技术国际会议(CI.

2026年传感器技术、自动化与智能制造国际会.

第九届计算机信息科学与人工智能国际学术会议(.

第二届先进电子、智能技术与计算国际学术会议(.

2026年IEEE计算机通信、信息系统与网络.

2026年通信, 数据科学与智能计算国际会议.

2026年第五届算法、数据挖掘和信息技术国际.

2026年IEEE第三届先进机器人, 自动化.

2026年人工智能与机器人系统国际会议(IC.

2026年IEEE第六届人工智能、自动化与算.

2026年IEEE人工智能、大数据与云计算国.

2026年第二届电力与可持续能源技术国际会议.

2026IEEE第三届亚洲先进电气与电力工程.

2026年第三届亚洲智能电网,绿色能源与应用.

2026年第九届数据科学和信息技术国际会议(.

2026年IEEE第九届算法, 计算与人工智.

2026年IEEE智能信息, 系统科学与工程.