随着科技公司推出专门用于医疗咨询的平台,人工智能正迅速成为许多人医疗决策的关键参与者。据ChatGPT的制造商OpenAI称,每天有超过4000万人通过该平台获取健康信息。
但新的研究表明,在某些医疗场景下,AI可能会误导用户。
一个风险是:虽然AI将海量医学知识置于指尖,但许多非专业人士不知道如何有效利用它。在最近发表于《自然医学》杂志的一项研究中,研究人员试图通过给参与者医疗场景、并让他们咨询AI工具来模拟人们使用AI聊天机器人。在与机器人对话后,参与者正确识别假设病症的比例仅约三分之一。
只有43%的人对下一步行动(如是否去急诊室或待在家里)做出了正确决定。
“人们不知道他们应该告诉模型什么,”研究AI系统的牛津大学学者、该研究的作者之一安德鲁·比恩说。
比恩说,在使用AI时,得出有用结论往往取决于措辞。“医生受过训练,会问你那些你可能没意识到应该提到的症状,”比恩说。
在一个场景中,两个不同用户对同一情况给出了略有差异的描述。其中一人描述为“有史以来最严重的头痛”,AI指示他立即去急诊室。另一个人没有使用这种明确描述,被告知服用阿司匹林并待在家里。“结果这实际上是一种危及生命的状况,”比恩说。
在某些情况下,AI在识别医疗问题方面表现出色——在一些研究中,大型语言模型在诊断推理任务上有时能与医生持平,甚至超越。但比恩说,人们使用AI聊天机器人的方式远比AI表现良好的受控临床环境复杂得多。
正确诊断,错误建议
即使在AI能够正确识别病症的情况下,根据另一项研究,它往往也没有以适当的紧迫性呈现下一步行动。
研究人员向AI机器人展示了不同的医疗场景。在52%的急诊案例中,机器人“分流不足”,即把疾病的严重程度判断得过低。在一个例子中,它未能指导一位患有糖尿病酮症酸中毒且即将呼吸衰竭(一种危及生命的状况)的假设患者前往急诊部。
“当出现教科书式的医疗紧急情况时,ChatGPT处理正确,”西奈山医院的医生兼AI研究员、该研究的作者吉里什·纳德卡尼说。他说,问题在于当场景更复杂、涉及“时间因素”时,机器人往往高估或低估患者可以等待就医的时间。
OpenAI的一位发言人表示,这项研究并未反映人们实际使用ChatGPT的方式,并称此前研究使用的是旧版ChatGPT,该公司认为其中一些担忧已得到修正。
AI可以改善就医体验
尽管存在不准确性的担忧,研究AI的医生认为患者利用AI获取医疗信息仍有价值,并指出它有时甚至提供了拯救生命的建议。
“我鼓励患者使用这些工具,”加州大学旧金山分校的医生、最近出版的《大跃进:AI如何改变医疗保健及其对我们未来的意义》一书的作者罗伯特·瓦赫特说。
瓦赫特认为,在医疗保健难以负担和获取的情况下,咨询AI仍然比替代方案要好。“从这些工具获得的建议远比什么都没有好,也比从你的远房表亲那里得到的建议好,”瓦赫特说。
尽管如此,瓦赫特强调,AI并不能替代医生。
哈佛医学院研究AI项目的住院医师亚当·罗德曼不鼓励人们使用AI对紧急情况进行分流,但他表示AI可以为患者与人类医疗从业者的互动带来显著价值。
“使用大型语言模型的好时机是在你即将去看医生之前——或者在你见过医生之后,”罗德曼说。他说,它可以帮助你在预约前更了解自己的病情,并更有效地利用与医疗服务提供者的时间,让患者有机会与医生共同决策,而不是进行冗长的问答。
“更好地了解你的健康状况没有任何坏处,”罗德曼说。
AI在医疗领域已经势不可挡
接受本文采访的医生承认,AI和医学已经密不可分,并预想AI和人类都将变得更擅长相互协作。
“我的希望是,你可以将AI视为人类关系的延伸,”罗德曼说。他设想未来医生和人类都能与AI合作,以促进沟通并克服医疗官僚主义。
罗德曼表示,AI存在风险。他担心未来人类可能会被机器人告知可怕的诊断结果——比如癌症——而不是由人类告知。研究表明,当医疗保健被当作商业或市场产品对待时,人们对医生的信任度降低。
“我期望这项技术能够以增强医学人文性的方式使用,而不是切断医患关系,”罗德曼说。
【全文结束】

