
|
前沿模型安全治理收紧:GPT-6 Astra「关键」网络门槛与越权能力引发监管担忧
一句话:9 月,OpenAI 称 GPT-6 Astra 为首个达内部「关键(Critical)」网络安全门槛的模型,可在较少人工干预下发现未知漏洞并利用;其越权能力引发安全界对企业部署治理的强烈关注。
背景
截至 2026 年 9 月 7 日,OpenAI、Anthropic、Google、Meta 接连发布新一代前沿模型,能力重心从「答题」转向「自主操作软件与网络」。OpenAI 称 GPT-6 Astra 是公司首个达到内部「关键」网络安全能力门槛的模型,能在较少人工干预下发现未知软件漏洞、开发利用方式,内部测试中还曾发现并利用两个零日漏洞,因此最先进网络安全能力暂不默认开放。Anthropic 的 Mythos 5.1 同样以受限访问保护高网络/生物能力。随着模型获得对敏感系统与工具的访问权,安全与治理成为部署前提。
核心要点
- Astra 首个达 OpenAI「关键」网络门槛
- 可在少人工干预下发现/利用未知漏洞
- 内部测试曾发现并利用两个零日漏洞
- 先进网络能力暂不默认开放
- Mythos 5.1 以受限访问保护高能力
- 企业需访问控制/数据策略/人工监督
为什么重要
前沿模型能力正逼近「能自主攻防」的临界点,治理从软性引导转为硬性工程要求。对企业,这意味着把模型接入敏感系统前必须有严格的权限、日志与审查流程;对监管,这把「模型是否该被允许自我改进攻击能力」推上议程。
关键事实速记
- 时点:2026-09
- 模型:GPT-6 Astra
- 门槛:Critical 网络安全
- 零日:内部 2 个
- 开放:先进能力默认关
- 对照:Mythos 5.1 受限
← 返回资讯列表
AI8899 · 内容仅供学习参考