Anthropic的"安全"Mythos级别模型为何不回答癌症相关问题
Anthropic公司新发布的Claude Fable 5模型(Mythos级别)虽具备强大功能,却设置了严格的安全防护机制,导致在回答癌症等基本生物学问题时会触发安全限制,自动回退到功能较弱的Opus 4.8版本。公司解释称这些过度保守的安全措施是必要的,旨在防止模型被用于高风险生物研究,包括生物武器开发。尽管早期数据显示超过95%的会话未触发回退,但安全分类器仍会将正常内容误判为风险。Anthropic表示正在改进这些措施以减少误报,并计划向生物学和生命科学社区提供不受限制的Mythos级别模型,以加速生物医学研究和药物发现进程,同时反映了AI技术快速发展背景下对安全风险的谨慎态度。

