人工智能工具已成为我们生活的关键部分。从编程到剧本写作,如今AI已被应用于许多行业。像ChatGPT这样的工具在回答健康相关查询和评估患者数据以提示症状方面可能非常有效。
宾夕法尼亚州立大学信息科学与技术学院副教授阿穆利亚·亚达夫发现,经委员会认证的医生评估,大型语言模型在回答健康相关查询时的正确率接近76%。这项研究正值人们开始向AI聊天机器人寻求健康建议之时,引发了关于AI是否值得信赖用于自我诊断的讨论。
AI“医生”正确率76%
研究人员为何开展这项研究?
据阿穆利亚·亚达夫称,研究团队希望了解AI聊天机器人是否有潜力成为下一代在线自我诊断工具。亚达夫表示:“长期以来,我们了解到人们如何使用谷歌等工具自我诊断健康症状。”他强调,先进的AI工具促使研究人员探究大型语言模型在健康建议方面是有益还是有害。他指出:“我们想了解,如果人们开始使用大型语言模型进行自我诊断,情况会变得更糟还是更好——也许它更有用。”
AI聊天机器人准确率如何?
亚达夫介绍,研究人员从参与者处收集了200多个健康相关提示,并将其提交给包括OpenAI的ChatGPT在内的多种大型语言模型。亚达夫指出,大型语言模型的准确率约为76%。他提到,ChatGPT表现最为出色。
AI能否帮助无法就医的人?
值得注意的是,亚达夫表示,其中一项主要发现与医疗可及性相关。这位教授指出,全球估计约有一半人口缺乏足够的医疗服务。“事实上,世界各地的人都可以使用这些大型语言模型获取健康建议,且正确率达76%,这似乎是一件很棒的事情,”他说。亚达夫认为,AI可以作为医疗专业人员难以获得的地区人们的重要资源。“如果一个人无法接触到任何医生,那么从语言模型那里获得一些不完美的帮助,难道没有道理吗?”亚达夫问道。
人们应该信任AI的医疗建议吗?
尽管结果令人鼓舞,但研究人员反复警告不要完全依赖AI做出医疗决策。“目前大型语言模型并不像人类医生那样准确,”亚达夫强调。他敦促用户在使用聊天机器人进行自我诊断时谨慎行事,并强调医疗专业人士在解读症状和医学建议方面远胜于AI。“我们在使用大型语言模型进行自我诊断时应非常谨慎,”他说。据亚达夫称,医生更有能力识别AI回答何时可能不准确或具有误导性。
【全文结束】

