GPT-6 Astra 发布:ExploitBench 满分,首个踩中 OpenAI「危急」网络安全阈值的模型
自己造出来的「开锁工具」在考试中拿了满分,该怎么办?OpenAI 的答案是:把它锁进保险库,钥匙只借给登记过的防御者。
三个关键信息
9 月 3 日,OpenAI 正式发布 GPT-6 Astra。这是该公司首个在自家预备框架(Preparedness Framework)下触及「Critical(危急)」网络安全能力阈值的模型——官方定义是:只要给它合适的工具和访问权限,它可以在无人干预的情况下发现未知的安全漏洞,并为防护严密的系统开发出可用的攻击代码。
数字比形容词更有冲击力。据 The Hacker News 报道,Astra 在 ExploitBench(把已知漏洞转化为可用攻击的基准测试)上拿到 100% 满分,而上一代 GPT-5.6 Sol 只有 78.5%;对 2026 年 6 月至 8 月间披露的高危漏洞,它能直接生成可运行攻击代码的比例达到 39.0%,是上一代 11.5% 的 3.4 倍;发布前的内部评估中,它还自己挖出了两个此前无人知晓的零日漏洞。另一面,它拦截越狱尝试的成功率从前代的 59% 升到 91.5%。
管控方式是分级放行:公开版本在发布时默认拒绝生成概念验证攻击代码,高级进攻能力只向经过审核的 Daybreak 计划参与者开放,用于漏洞验证、恶意软件分析等防御性工作。
王斗视角
这场发布会最耐人寻味的不是「迈向 AGI」的修辞,而是那份成绩单本身:一个漏洞利用考试满分的模型,安全方案是一份宾客名单。锁匠给全城的保险柜配出了万能钥匙,然后宣布——放心,钥匙只借给登记过的人。问题在于,39% 的高危漏洞已经能被机器直接变成武器,剩下那 61% 挡在门外的不是技术,只是模型还没练熟;等它练熟,进攻和防守用的将是同一个脑子、同一份能力,区别只剩谁先拿到访问权。所以别把 Astra 当成一次模型升级,它是攻防市场的一次重新定价:以后网络安全拼的不是谁家工程师多,而是谁在名单上。名单外的公司,裸奔速度将以月为单位加快。
