|
Anthropic Fable 5.1 收紧又放宽安全护栏:网络安全误报减少 60%,可发现漏洞但不写利用
一句话:9 月 1 日,Anthropic 发布 Claude Fable 5.1 与受限的 Mythos 5.1。新版安全分类器在网络安全场景误报减少 60%,Fable 5.1 可用于发现软件漏洞,但不得生成漏洞利用代码。
背景
2026 年 9 月 1 日,Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1,两者同底权重、不同安全护栏。Fable 5.1 全渠道开放,Mythos 5.1 仅通过可信访问计划(网络安全与生命科学)向受审核机构开放。Anthropic 称其最新安全护栏在网络安全场景下误报减少 60%——此前过度审查常把合法安全分析误判为有害。Fable 5.1 现在可用于发现软件漏洞,但不得开发漏洞利用(exploit);Mythos 5.1 在更宽松护栏下于 Terminal-Bench 4.0 达 60.9%。此外 Anthropic 推出企业前沿护栏(EFS),数据存于客户自控云基础设施,提供近似零数据留存级别的隐私。
核心要点
- 9-1 发布 Fable 5.1 + 受限 Mythos 5.1
- 同底权重、不同安全护栏
- 网络安全误报减少 60%
- Fable 5.1 可发现漏洞、但不可写 exploit
- Mythos 5.1 Terminal-Bench 4.0 达 60.9%
- 企业前沿护栏 EFS:数据存客户自控云
为什么重要
这是前沿模型安全治理的成熟样本:既把「能发现漏洞但绝不写利用」的能力边界制度化,又用更低误报换来提高安全 agent 可用性。可信访问双轨制(公开版 + 受限高能力版)正成为行业模板,也为监管提供了「可控释放」的参考范式。
关键事实速记
- 发布:2026-09-01
- 型号:Fable 5.1 / Mythos 5.1
- 误报:网络安全 -60%
- 能力边界:可发现/不可利用
- 缓存读:0.25 美元/MTok(-75%)
- 渠道:API/Bedrock/Vertex/Foundry
← 返回资讯列表
AI8899 · 内容仅供学习参考