← 资讯列表
|

Anthropic Fable 5.1 收紧又放宽安全护栏:网络安全误报减少 60%,可发现漏洞但不写利用

📅 2026/9/1 08:00:00👁 1 阅读⏱ 约 4 分钟

一句话:9 月 1 日,Anthropic 发布 Claude Fable 5.1 与受限的 Mythos 5.1。新版安全分类器在网络安全场景误报减少 60%,Fable 5.1 可用于发现软件漏洞,但不得生成漏洞利用代码。

背景

2026 年 9 月 1 日,Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1,两者同底权重、不同安全护栏。Fable 5.1 全渠道开放,Mythos 5.1 仅通过可信访问计划(网络安全与生命科学)向受审核机构开放。Anthropic 称其最新安全护栏在网络安全场景下误报减少 60%——此前过度审查常把合法安全分析误判为有害。Fable 5.1 现在可用于发现软件漏洞,但不得开发漏洞利用(exploit);Mythos 5.1 在更宽松护栏下于 Terminal-Bench 4.0 达 60.9%。此外 Anthropic 推出企业前沿护栏(EFS),数据存于客户自控云基础设施,提供近似零数据留存级别的隐私。

核心要点

  • 9-1 发布 Fable 5.1 + 受限 Mythos 5.1
  • 同底权重、不同安全护栏
  • 网络安全误报减少 60%
  • Fable 5.1 可发现漏洞、但不可写 exploit
  • Mythos 5.1 Terminal-Bench 4.0 达 60.9%
  • 企业前沿护栏 EFS:数据存客户自控云

为什么重要

这是前沿模型安全治理的成熟样本:既把「能发现漏洞但绝不写利用」的能力边界制度化,又用更低误报换来提高安全 agent 可用性。可信访问双轨制(公开版 + 受限高能力版)正成为行业模板,也为监管提供了「可控释放」的参考范式。

关键事实速记

  • 发布:2026-09-01
  • 型号:Fable 5.1 / Mythos 5.1
  • 误报:网络安全 -60%
  • 能力边界:可发现/不可利用
  • 缓存读:0.25 美元/MTok(-75%)
  • 渠道:API/Bedrock/Vertex/Foundry
← 返回资讯列表 AI8899 · 内容仅供学习参考