从搜索到聊天:“AI医生”准备好为乳糜泻患者服务了吗?From Searching to Chatting: Is “Dr. AI” Ready for Patients with Celiac Disease? - Celiac Canada

环球医讯 / AI与医疗健康来源:www.celiac.ca加拿大 - 英语2026-08-27 15:22:23 - 阅读时长6分钟 - 2835字
本文通过一项对比研究,评估了ChatGPT、Google Bard等主流AI聊天机器人在提供乳糜泻和无麸质饮食信息方面的准确性、清晰度和完整性。研究发现,虽然ChatGPT表现最佳,但所有聊天机器人都存在信息不完整、不准确甚至有害的问题,例如建议儿童逐步引入含麸质食物。作者强调,AI聊天机器人目前尚不能替代医疗专业人士,患者应谨慎对待,并优先咨询医生或营养师以及可信赖的组织如加拿大乳糜泻协会。
乳糜泻无麸质饮食AI聊天机器人健康信息准确性患者护理营养师幻觉互联网信息
从搜索到聊天:“AI医生”准备好为乳糜泻患者服务了吗?

作者:Alyssa Ramuscak, RD,加拿大乳糜泻协会研究分析师,2026年3月25日

20世纪90年代和21世纪初,是人们获取信息方式的关键转折点。随着互联网和谷歌等搜索引擎的兴起,来自世界各地的信息突然变得触手可及。虽然这极大地增加了知识的获取,但也带来了新的挑战:如何判断哪些信息是准确且值得信赖的。

如今,随着机器学习和人工智能的快速发展和公众可及性,一场新的技术变革正在发生。人工智能(AI)是指能够处理大量数据、识别模式并遵循详细指令来执行任务的计算机系统。虽然计算机无法像人类一样思考、强调或推理,但科学家们已经开发出能够模仿人类智能某些方面的系统,例如从数据中学习并应用知识解决问题。我们许多人已经在日常生活中接触到简单的AI形式,例如根据我们的浏览或购买历史预测我们可能感兴趣的产品的在线广告。(1)

最近,生成式AI——一种旨在创建类似人类生成的文本、图像或代码等新内容的AI——引起了广泛关注。2022年11月,最知名的生成式AI平台之一ChatGPT正式向公众发布,并迅速普及,在头两个月内就获得了超过1亿用户。(2) 通过该平台,用户将提示或问题输入搜索栏,并在几秒钟内收到AI生成的回复。虽然生成式AI可以快速汇总信息,减少通常需要跨多个网站搜索的时间和精力,但也引发了一个熟悉的担忧:它提供的信息有多准确和可信?

Jansson-Knodell及其同事(3)最近的一项研究旨在探讨这个问题,他们评估了AI聊天机器人提供乳糜泻和无麸质饮食信息的准确性。以下是他们的发现!

Jansson-Knodell及其同事(2025):人工智能聊天机器人尚未准备好用于乳糜泻患者护理。

在这项对比研究中,作者使用了一系列10个关于乳糜泻的基础问题,向四个最知名且免费的AI聊天机器人提问:Google的Bard、Open AI的ChatGPT-4、微软必应聊天(精确模式)和微软必应聊天(创意对话模式)。每个回答由两位胃肠病学家和两位在乳糜泻和无麸质饮食方面具有专业知识的营养师进行评估。评估内容包括关键信息缺失、事实错误和清晰度。

在第二次分析中,作者使用ChatGPT提供一周的无麸质饮食计划、购物清单和费用。菜单经检查确认是否符合无麸质饮食要求,并进行定性评估。

总体而言,研究发现AI聊天机器人提供的关于乳糜泻和无麸质饮食的信息质量参差不齐。虽然有些回答准确且有用,但聊天机器人之间的信息质量差异很大,其中ChatGPT在整体有用性(90%)、清晰度(90%)、无信息缺失(90%)和无错误(82.5%)方面表现最佳,而Google Bard表现最差:整体有用性(45%)、清晰度(55%)、无信息缺失(65%)和无错误(65%)。

在许多情况下,作者指出AI聊天机器人提供了不完整、令人困惑甚至错误的信息。例如,ChatGPT提供了一条有害信息,声称“如果您的孩子患有乳糜泻,建议逐渐引入含麸质食物。”此外,虽然ChatGPT能够提供一份准确的1周饮食计划,其中所有75项都被列为无麸质,但作者指出,这些回答有时含糊不清、缺乏深度或重复。例如,ChatGPT提供的购物清单没有提供总费用,没有包含饮食计划中的所有食材,也没有提供品牌、产品或食谱。

这些发现强调,尽管AI聊天机器人日益流行,但它们目前还不足以作为患者健康信息的独立来源。虽然它们可能成为寻求快速信息的人的有用补充资源,但作者强调,它们不太可能取代医疗专业人士(如注册营养师)的专业知识,后者能够为管理乳糜泻提供个性化和可靠的指导。

重要考虑因素

  1. 回答的质量取决于您提供的提示。

生成式AI的回答质量取决于您给出的提示、指令或问题。具体化并包含相关细节可能有助于提高您收到的回答质量。

  1. 回答可能因搜索而异。

由于提示的多样性,AI生成的回答并不总是一致的。这使得研究结果难以重现。虽然该研究发现了聊天机器人之间的性能差异,但您自己的结果也可能因提问方式而异。

  1. AI从互联网上的信息中提取。

生成式AI模型基于大量在线信息进行训练。因此,它们可能提供不适用于您所在地区的通用回答。例如,在一个国家被视为无麸质的产品可能不符合加拿大的无麸质标准。

  1. AI容易产生幻觉。

在AI中,当系统产生听起来自信且文笔流畅但实际上是错误的信息时,就会发生幻觉。这可能是由于训练数据中的空白、模型做出的错误假设或训练所用信息中的偏见造成的。(4) 因此,有时很难判断所提供的信息是否准确。

结论

虽然像ChatGPT这样的生成式AI聊天机器人可以快速提供信息,但它们可能还不是获取乳糜泻和无麸质饮食准确指导的可靠来源。

就像20世纪90年代和21世纪初互联网早期一样,谨慎对待在线信息非常重要。在管理乳糜泻方面,您的医疗团队和值得信赖的组织(如加拿大乳糜泻协会)仍然是获取准确和个性化信息的最佳来源。

如需阅读全文,请参阅:

Jansson-Knodell CL et al. Artificial intelligence chatbots not yet ready for celiac disease patient care. Clin Gastroenterol Hepatol. 2025 May; 23(6):1065-1067.ei. doi: 10.1016/j.cgh.2024.10.012.

参考文献

  1. What is AI, how does it work and why are some people concerned about it? BBC. July 29, 2025. Accessed March 14, 2026.
  2. Cacciamani GE, Siemens DR, Gill I. Generative Artificial Intelligence in Health Care. Journal of Urology. 2023;210(5):723-725. doi:10.1097/JU.0000000000003703
  3. Jansson-Knodell CL, Gardinier D, Weekley K, Yang Q, Rubio-Tapia A. Artificial Intelligence Chatbots Not Yet Ready for Celiac Disease Patient Care. Clinical Gastroenterology and Hepatology. 2025;23(6):1065-1067.e1. doi:10.1016/j.cgh.2024.10.012
  4. Google Cloud Topics. What are AI hallucinations? Google Cloud. 2026. Accessed March 14, 2026.

【全文结束】

猜你喜欢
  • 健康保险覆盖范围现在由AI决定——你需要了解其保险角色健康保险覆盖范围现在由AI决定——你需要了解其保险角色
  • AI与医疗设备网络安全:好与坏AI与医疗设备网络安全:好与坏
  • 人工智能、医学伦理与外科未来:大型外科会议将移师珀斯人工智能、医学伦理与外科未来:大型外科会议将移师珀斯
  • 三星医疗中心以AI就绪系统树立智慧医院转型新标杆三星医疗中心以AI就绪系统树立智慧医院转型新标杆
  • 乳糜泻削弱了分解纤维的肠道微生物乳糜泻削弱了分解纤维的肠道微生物
  • 乳糜泻可能削弱高纤维益处:当关键肠道微生物缺失时乳糜泻可能削弱高纤维益处:当关键肠道微生物缺失时
  • 业界之声——医院正在推动AI创新,他们应该分一杯羹吗?业界之声——医院正在推动AI创新,他们应该分一杯羹吗?
  • Mercy减少拒赔与反击支付方AI的收入周期策略内幕Mercy减少拒赔与反击支付方AI的收入周期策略内幕
  • Insight Health筹集1100万美元以扩大临床AI代理规模Insight Health筹集1100万美元以扩大临床AI代理规模
  • AI医疗文档系统如何改变临床工作流程AI医疗文档系统如何改变临床工作流程
热点资讯
全站热点
全站热文