越来越多的患者不再直接去看医生,而是首先咨询聊天机器人关于他们的症状。人工智能能够快速、清晰且无需排队地做出回应。但这些回答对患者来说安全吗?
这个问题是由弗罗茨瓦夫医科大学的研究人员和学生提出的,他们分析了语言模型如何处理关于尿路结石的最常见问题。发表在《人工智能评论》期刊上的这项研究表明,AI生成的答案通常是正确的且具有实质性价值。同时,它揭示了AI最大的弱点:不是明显的错误,而是缺乏完整的临床背景,这在医学中至关重要。
最大的风险是"几乎正确"的答案
语言模型很少提供完全错误的答案。更常见的情况是提供部分准确的信息——听起来可信但省略了重要诊断或治疗细节的答案。这些答案恰恰可能导致患者做出错误的决定。
该研究的合著者、大学泌尿中心的住院医师兼博士候选人沃伊切赫·托姆查克(Wojciech Tomczak)强调:"从临床角度看,部分准确的答案比明显错误更重要——因为当它们听起来可信但不能反映完整的诊断或治疗背景时,对患者最具误导性。"
肾结石
尿路结石疾病是一种治疗方法取决于多种因素的病症——从观察和保守治疗到手术干预。这就是为什么简化的答案可能特别危险。
托姆查克表示:"在这个类别中,不正确或仅部分准确的回答尤其危险,因为它们可能鼓励患者自行用药或忽视警示症状。"
实际上,这意味着依赖AI回答的患者可能会延迟寻求医疗护理,或自行采取不适当的行动。在极端情况下,后果可能非常严重,包括肾功能丧失、严重感染甚至死亡。
为什么AI看起来可信?
从用户的角度来看,聊天机器人具有显著优势:它们易于理解、结构清晰且听起来令人信服。问题在于患者通常无法识别完整且医学上准确的答案与简化或不完整的答案之间的区别。
托姆查克说:"从患者的角度来看,这种差异可能不会明显察觉,因为接收者通常主要通过答案的清晰度和表面可信度来评估它。这使得即使是不完整或简化的信息也显得足够。"
AI作为支持
研究作者强调,语言模型在健康教育方面具有真正的潜力。它们有助于澄清问题、组织知识并为与医生的对话做准备。然而,这需要有意识地使用这些工具。
托姆查克表示:"情况的最终评估应该始终由医生进行。"因此,医疗咨询的关键作用仍然存在,在此过程中,先前获得的信息可以得到验证并置于特定病例的背景中。
技术只是部分解决方案
弗罗茨瓦夫医科大学团队的这项研究表明,AI在医学中的发展并不会消除健康教育的需要。相反,患者需要可靠的知识来源、批判性评估信息的能力以及轻松获得专家的机会。
聊天机器人可以是理解症状的第一步。它不应该是最后一步。
更多信息
Wojciech Tomczak等人,《尿石症患者咨询中AI生成答案的质量:ChatGPT和Deepseek的比较研究》,《人工智能评论》(2025)。DOI: 10.1007/s10462-025-11478-2
关键医学概念
肾结石病(Nephrolithiasis)、尿路结石病(Urolithiasis)、肾衰竭(Kidney Failure)、败血症(Sepsis)
临床类别
泌尿科(Urology)、常见疾病与预防(Common illnesses & Prevention)
【全文结束】

