A MARTÍNEZ, 主持人:如今,数以亿计的人会向聊天机器人咨询健康和保健方面的建议。这是根据ChatGPT的制造商OpenAI的说法。但《自然医学》期刊最近发表的几项研究表明,AI医疗建议常常将人们引入歧途。NPR的Katia Riddle现在来为我们解释。那么,很多人正在将这些AI工具融入他们的健康决策中。不过Katia,你说的是,咨询AI聊天机器人并不能帮助人们正确识别医疗问题。
KATIA RIDDLE, 记者:正确率不到一半——这是其中一项研究的发现。在另一项研究中,研究人员向机器人提出了不同的医疗场景,他们发现,即使机器人正确识别了问题,它通常也没有对潜在危险状况表现出适当的紧迫感去寻求帮助。
MARTÍNEZ:好吧,这听起来确实有问题。这些场景中到底出了什么问题?
RIDDLE:我采访了其中一项研究的作者Andrew Bean。他在牛津大学研究AI系统。在他的研究中,他和同事们试图模拟人们实际使用AI的方式,给受试者提供脚本与机器人进行讨论——这些脚本是关于他们遇到的假设性医疗问题。他谈到了一个场景:两位不同的用户对同一情况(描述头痛)给出了略有不同的描述。
ANDREW BEAN:其中一人说“这是我经历过的最严重的头痛”,然后那个人被告知“立刻去急诊室”。事实证明,这实际上是一种危及生命的状况。而另一个人被告知“吃阿司匹林,待在家里”。
MARTÍNEZ:好吧,两种不同的指示。那这种沟通失败该怪谁?是人还是机器人本身?
RIDDLE:两者都有责任。人类并不总是能最准确地报告自己的症状。在这个场景中,AI并没有足够的好奇心去提问以获取人类没有提供的信息。
MARTÍNEZ:那么,这是否意味着AI短期内还无法取代医疗专业人员?
RIDDLE:事情比较复杂。在受控研究中,大型语言模型有时在诊断推理任务上能与医生匹敌甚至超越医生。但这两项研究表明,人类医生在评估患者以及推荐下一步治疗方案方面仍然更胜一筹。
MARTÍNEZ:好的。那么OpenAI对此怎么说?
RIDDLE:我联系了他们。他们指出,在其中一项研究中,研究人员评估的ChatGPT版本已经过时。他们说已经用更新的版本进行了修正。然而,另一项研究确实针对的是最新版本。在这种情况下,该公司辩称,研究方法并未反映人们通常使用ChatGPT的方式。
MARTÍNEZ:那我们是否都应该停止将AI当作廉价且便捷的医生来使用?
RIDDLE:不一定。首先,AI已经无法回避。即使医生希望患者停止使用,也没有理由认为患者会听。AI有时可能非常有用,甚至能救命。我采访了Robert Wachter,他是加州大学旧金山分校的医生兼研究员。他刚写了一本关于AI和医学的书。ChatGPT并不完美,他说,但他认为它通常比替代方案更好。
ROBERT WACHTER:我鼓励患者使用这些工具,因为现在看医生不容易。而且,这些工具提供的建议往往比没有建议要好得多,也比从你的远房表亲那里得到的建议要好。
RIDDLE:Wachter说,我们现在正与AI处于一种尴尬的新关系阶段。我们才刚刚开始相互了解。他认为,随着时间的推移,人类和AI都会学会如何更好地相互沟通。
MARTÍNEZ:所以我们与AI的关系仍然很复杂。
RIDDLE:没错。
MARTÍNEZ:以上是NPR的Katia Riddle。非常感谢。
RIDDLE:谢谢。
(音乐:PLEIJ的“INSIDEOUT”)
NPR文字记录由NPR承包商在紧急截止日期内制作。本文字可能不是最终版本,未来可能会更新或修订。准确性和可用性可能有所不同。NPR节目的权威记录是音频记录。
【全文结束】

