Anthropic 优化 Claude Fable 5 模型生物安全机制,减少 85% 误拦截
IT之家 8 月 8 日消息,美国人工智能初创企业 Anthropic 昨日发布博文称,公司正在更新 Claude Fable 5 模型的生物安全防护机制,大幅减少误拦截现象发生。如今 Fable 5 用户提出生物学相关问题后,系统的降级情况将更少发生。

据 Anthropic 官方测试数据,**本次更新使生物学相关问答的降级现象减少了 85%**,Fable 5 现在可以处理更广泛的生物学任务。
Anthropic 表示,某些恶意用户会使用 Fable 5 模型进行生物武器研究等高风险活动。因此公司为了防范这种现象发生,专门为 Claude 设置了安全分类器(safety classifiers),用于检测用户是否要求 Fable 5 执行受保护的生物学任务,或者生成有害内容。

如今 Anthropic 调整了安全分类器的工作机制,让它能够更准确地区分无害问题和高风险问题。
不过为了防范持续的 AI 风险,Fable 5 仍会限制专业生物学研究和药物开发相关请求。
---
原文链接:[点击查看](https://www.ithome.com/0/987/323.htm)

据 Anthropic 官方测试数据,**本次更新使生物学相关问答的降级现象减少了 85%**,Fable 5 现在可以处理更广泛的生物学任务。
Anthropic 表示,某些恶意用户会使用 Fable 5 模型进行生物武器研究等高风险活动。因此公司为了防范这种现象发生,专门为 Claude 设置了安全分类器(safety classifiers),用于检测用户是否要求 Fable 5 执行受保护的生物学任务,或者生成有害内容。

如今 Anthropic 调整了安全分类器的工作机制,让它能够更准确地区分无害问题和高风险问题。
不过为了防范持续的 AI 风险,Fable 5 仍会限制专业生物学研究和药物开发相关请求。
---
原文链接:[点击查看](https://www.ithome.com/0/987/323.htm)
评论
暂无评论。