昨日,美国人工智能初创企业Anthropic宣布对ClaudeFable5模型的生物安全防护机制进行更新,旨在减少误拦截现象。此次更新后,Fable5在处理生物学相关问题时的降级情况将大幅减少。根据官方测试数据,生物学相关问答的降级现象减少了85%,使得Fable5能够处理更广泛的生物学任务。
Anthropic表示,为了防止恶意用户利用Fable5模型进行生物武器研究等高风险活动,公司专门为Claude设置了安全分类器,用于检测用户是否要求Fable5执行受保护的生物学任务或生成有害内容。此次更新调整了安全分类器的工作机制,使其能够更准确地区分无害问题和高风险问题。尽管如此,为了防范持续的AI风险,Fable5仍将限制专业生物学研究和药物开发相关请求。

