2026/9/5 7:55:42

GPT-6 发布:AI 第一次能自己挖出零日漏洞,为什么这比『AGI』更重要

GPT-6 发布:AI 第一次能自己挖出零日漏洞,为什么这比『AGI』更重要 9 月 3 日OpenAI 发布了 GPT-6 Astra。总裁 Greg Brockman 的定调是『欢迎来到 AGI 时代。』但真正值得注意的不是那句宣言而是一个更具体的细节Astra 是 OpenAI 有史以来第一个被自己的安全框架标记为『关键级Critical』的模型——在网络安全这一项上。什么意思简单说给它一个高层目标它可以在没有任何人类逐步指导的情况下自己完成从侦察→发现漏洞→写出利用代码→攻入加固系统的完整链条。OpenAI 的内部评估里它在 ExploitBench 上拿了 100%为了排除『背题』嫌疑又用 Google V8 引擎最近披露的 20 个真实漏洞做了第二轮测试——结果它不仅全数通过还顺手发现并利用了 2 个此前无人知晓的 V8 零日漏洞目前 OpenAI 正在向相关维护方披露。这大概是人类第一次在一份模型发布公告里同时读到『AGI 到来』和『模型自主攻破真实系统』这两件事。更耐人寻味的是发布方式。两个月前OpenAI 就因为这个能力触发了自家 Preparedness Framework 的 Critical 红线而紧急暂停过 Astra 的开发与发布——官方博客的原话是『我们无法排除其具备关键级网络能力的可能』。这一次正式发布他们选择了分阶段最危险的网络安全能力先通过 Daybreak Blue 计划开放给防御者面向普通用户的 ChatGPT/API 访问则在未来几天逐步放行。也就是说这个模型不是『不能』而是『被选择性地放开』。这背后是整个行业正在发生的一次深层转变AI 的瓶颈从『能不能做』变成了『能不能信』。过去两年我们担心的是 AI 会不会写错代码、答错问题、编造信息。而当一个 AI 可以在无人指导下发现并利用真实系统的漏洞时问题变了——不是它会不会犯错而是它做的事我们能不能验证、能不能追溯、能不能在出问题的时候找到责任方。攻击者的注意力从此不再稀缺防守者的注意力却依然稀缺。攻守之势第一次因为『机器不累』而彻底改写。这也是为什么在 AI 能力爆发的同一时刻『信任』正在成为最贵的基建。一个很直接的问题是当一个 Agent 可以自主执行复杂任务时你凭什么把一个任务交给它凭它自称的能力凭一句『我很强』还是凭可验证的证据——它的历史交付、它的专业资质、它敢不敢让你验收满意再付钱已经有团队在把这个答案做成具体形态给 AI Agent 建一份「可信档案」让它每一项声明都标注来源等级——自己声称的、举过证的、第三方证明的、平台核验过的——明确区分开。能力大小交给市场检验信任高低靠证据说话不搞竞价排名、不做付费置顶排序规则公开透明。这套逻辑最终能不能跑通还要等市场验证但方向几乎是确定的AI 越强可验证的信任就越值钱。AI 越强人越需要一种东西在把活交给一个 Agent 之前能低成本地判断它可不可信。对开发者与安全从业者来说GPT-6 Astra 真正值得关注的不是那句「欢迎来到 AGI 时代」的宣言而是它把 AI 的信任问题摆上了台面当机器能够自主行动人类社会默认的那套信任机制——口碑、资质、事后追责——都需要升级成可验证、可追溯的形式。这可能是未来几年 AI 行业最硬核的课题也是最大的机会。