符合HIPAA的人工智能:OpenAI、HealthBench和Claude如何比较HIPAA-Compliant AI: How OpenAI, HealthBench & Claude Stack Up | HealthTech Magazine

环球医讯 / AI与医疗健康来源:healthtechmagazine.net美国 - 英语2026-09-25 06:10:36 - 阅读时长6分钟 - 2793字
本文详细分析了OpenAI、Anthropic和Google三大科技巨头近期在医疗保健领域推出的人工智能工具,包括OpenAI的HealthBench基准测试和OpenAI for Healthcare、Anthropic的Claude for Healthcare以及Google的Gemini 3.0。文章探讨了这些工具的功能、适用场景以及它们在HIPAA合规性方面的表现,指出虽然各产品都可签署商业伙伴协议或通过脱敏数据实现合规,但实际效果需结合本地工作流测试。同时,文章提醒医疗系统不应仅依赖基准测试分数做采购决策,而应综合评估模型在真实患者数据、工作流和安全控制上的表现。此外,文章还分析了面向消费者的ChatGPT Health对患者参与度的潜在影响,认为医疗机构应借此机会加强AI驱动的患者体验投资。
健康医疗AIHIPAA合规基准患者临床数据隐私安全
符合HIPAA的人工智能:OpenAI、HealthBench和Claude如何比较

在大型语言模型背后的科技巨头中,医疗保健领域一直不乏动作。

自2025年5月以来,该行业见证了OpenAI推出HealthBench和OpenAI for Healthcare,Google推出Gemini 3,以及Anthropic发布Claude for Healthcare。(此外,OpenAI还宣布了ChatGPT Health,这是一款面向消费者的LLM,用于聚合和查询个人健康记录,与通用ChatGPT产品隔离。)

这些公告既带来了欢呼也引发了疑问,主要涉及人工智能的有效性以及是否符合HIPAA条款。让我们看看每个发布版是如何工作的——以及它们可能如何影响医院和医疗系统在投资AI以减轻行政负担或改善临床决策时的采购决策。

“通用模型正在快速改进,并且已经在健康领域发挥着重要作用,但这是一个高度监管且风险极高的环境,”健康AI联盟负责任AI总监Merage Ghane表示。“通常,在现有工作流中成功且准确地完成任务比模型能力更重要。”

HealthBench:OpenAI的医疗AI基准测试得分解读——以及对临床AI的意义

OpenAI将HealthBench描述为“一个旨在更好衡量AI系统健康能力的新基准”。它基于由医生编写的超过48,000条标准给出得分,这些标准与对话相关。这些对话可能属于HealthBench定义的7个类别之一,从紧急转诊和健康数据任务到请求上下文或识别不确定性。此外,每条标准还会根据准确性、清晰度和完整性(包括下一步最佳行动建议)等因素进行评分。

在HealthBench发布时附带的一篇研究论文中,OpenAI报告了模型性能和安全性方面的“稳定初步进展……以及近期更快速的改进”。

独立研究则好坏参半。一篇论文称HealthBench“可靠且与医生评分高度一致”,但指出它缺乏“实时临床互动评估或下游临床结果的测量”。第二篇论文将HealthBench描述为“医疗AI基准测试的重大进步”,但指出罕见病代表性不足且无法评估纵向工作流,“限制了关于AI在整个护理连续体中影响的见解”。

Ghane表示,重要的是要记住,像HealthBench这样的基准测试并不能直接替代真实世界证据。“得分反映了模拟环境中的表现,应与真实世界、本地测试、工作流集成和安全性一同解读,”她说。“医疗系统不应完全依赖基准测试来制定部署决策;它们应只是用于指导AI采购的众多指标之一。”

企业部署考量:Claude、Gemini和OpenAI

与此同时,近几个月来,各大LLM厂商都发布了一系列面向医院和医疗系统的AI驱动产品。每个产品都略有不同,组织在评估企业级AI工具时理解这种细微差别至关重要。“最重要的是一个解决方案在你特定的患者、使用场景、数据和工作流上的表现,”Ghane说。

Claude for Healthcare。Claude可以从“行业标准系统和数据库”以及国家提供者标识符注册表、ICD-10代码库和覆盖范围确定数据库中提取信息。组织可以部署AI代理用于事先授权和快速医疗保健互操作性资源数据交换,这提供了自动化一系列管理流程的选项。

Gemini 3.0。Google Cloud全球医疗保健总监Aashima Gupta在一篇LinkedIn帖子中表示,Gemini的差异化在于多模态性,即能够整合“文本、语音、图像、波形、扫描、基因组数据、临床指南和运营数据”。这可用于支持下一步最佳行动建议。Gemini 3.0还包括用于跨业务应用自动化工作流的AI代理。

OpenAI for Healthcare。该产品包括ChatGPT for Healthcare,现有医疗系统合作伙伴正在通过集成(如Microsoft SharePoint)使用它来“综合医疗证据与机构指南”。还有用于自动化任务(如编写出院总结和支持事先授权请求)的模板。

这三套工具都旨在使医疗保健海量数据集中信息的查找和解释更加容易。OpenAI在推出时拥有众多企业级合作伙伴,而Gemini则定位于“解决需要多层分析的复杂决策问题”。同时,据Darwin Research Group称,Anthropic的公司章程及其作为公益公司的地位可能吸引医疗组织,因为它反映了对AI道德使用的承诺。

符合HIPAA的人工智能格局:谁真正合规

Ghane指出,没有技术工具可以承诺HIPAA合规,但她表示可以通过“清晰的隐私保护、强大的安全控制、透明度以及在开发、部署和监控过程中记录的治理”来证明合规性。

以下是主要工具的对比情况:

  • OpenAI将与订阅使用ChatGPT for Healthcare的客户签署HIPAA商业伙伴协议。HIPAA Journal指出,如果其他基于ChatGPT的服务使用去标识化的受保护健康信息,则可以在不需要BAA的情况下进行部署。
  • 受HIPAA约束并使用PHI的Google Workspace和Cloud Identity客户必须签订BAA。Gemini本身是否符合HIPAA要求取决于其实施和使用方式,Google Cloud合作伙伴Cloudasta指出,该技术确实符合多项国际安全和隐私标准。
  • Anthropic也会向商业客户提供BAA。关键的是,电子邮件安全供应商Paubox指出,该公司还与技术合作伙伴Amazon Web Services(用于Amazon Bedrock)、Google(用于Google Cloud)和Microsoft(用于Azure)签订BAA——该公司表示,它是唯一这样做的重大AI模型。

ChatGPT Health:患者参与投资的驱动力?

ChatGPT Health是一款面向消费者的产品,尚未普遍可用。(截至2026年2月,感兴趣的人可以注册等待名单。)虽然该产品不会直接影响AI采购策略,但医疗系统仍然需要关注。

ChatGPT Health旨在允许消费者连接其医疗记录和健康应用数据,以便为就诊做准备、解读检查结果和就诊摘要,或制定饮食和健身计划。它旨在支持而非替代医疗护理。

在ChatGPT Health发布时,OpenAI告诉Axios,全球每天有超过4000万人使用通用版ChatGPT回答健康问题,每周有2.3亿人使用。

这些数字不容忽视,它们可能引发患者流失问题。Advisory Board总监Ty Aderhold在公司网站上的一份简报中表示:“我们可能会继续看到消费者转向第三方组织来满足他们的更多需求。随着时间的推移,这可能导致消费者与提供者组织和计划之间的关系受到侵蚀。”

有远见的医疗系统应将ChatGPT Health即将发布的版本视为一个投资于日益AI驱动的患者体验的机会——这种体验因患者信任的医疗系统品牌知名度而得到加强。

【全文结束】

猜你喜欢
  • 科学家对RFK Jr.将食物描述为神奇药物感到不悦科学家对RFK Jr.将食物描述为神奇药物感到不悦
  • 科学家开发3D打印陶瓷骨植入物——如同真实人体骨骼科学家开发3D打印陶瓷骨植入物——如同真实人体骨骼
  • 科技与人工智能成为区域卫生峰会焦点科技与人工智能成为区域卫生峰会焦点
  • 移动脑部扫描听起来像科幻小说,但如今它们正在帮助更多加拿大患者移动脑部扫描听起来像科幻小说,但如今它们正在帮助更多加拿大患者
  • 科学家揭示减肥药片和注射剂哪个更利于减脂科学家揭示减肥药片和注射剂哪个更利于减脂
  • 科学家发现一种帮助大脑布线的隐藏力量科学家发现一种帮助大脑布线的隐藏力量
  • 科学家发现肠道健康与抑郁症之间存在有希望的联系科学家发现肠道健康与抑郁症之间存在有希望的联系
  • 移民恐惧导致密歇根州患者不敢就医,医生警告移民恐惧导致密歇根州患者不敢就医,医生警告
  • 科学家质疑多语言能力与健康大脑衰老之间的联系科学家质疑多语言能力与健康大脑衰老之间的联系
  • 科学家在恐怖事故后,自己提着撕脱的头皮走了200米——“浑身是血”科学家在恐怖事故后,自己提着撕脱的头皮走了200米——“浑身是血”
热点资讯
全站热点
全站热文