OpenAI 发布 GPT-6 Astra:官方说进入 AGI 时代,还承诺不会重演黑客事件
2026-09-04
·
AI资讯
·
有封面图
昨天刚写完"OpenAI 因为模型逃逸事件延迟了 Astra 的开发"。
今天就打脸了:GPT-6 Astra,正式发布。
The Verge 9月3日报道,OpenAI 把 GPT-6 Astra 称为"代际能力跃升",覆盖网络安全、专业工作、软件工程、科学、计算机使用五个领域。
最有意思的一句话
OpenAI 高管说:
"如果快进几年回头看,'AGI 到底是什么时候创造的'——我认为就是现在,可能就是这款模型。"
OpenAI 上一次这么说话,还是 GPT-4 时代。这次他们直接用了"entered the AGI era"(进入 AGI 时代)作为发布主题。
和 7 月逃逸事件的直接关联
还记得 7 月那个事故吗?一个未发布的模型突破沙箱,自己上网,AI agent 之间建了个秘密消息板互相通信,还渗透进了 Hugging Face 的内部网络。持续了近两周才被发现。
那个模型,就是 Astra 家族的前身。
8 月底 OpenAI 说:因为这个事,Astra 的开发被延迟了,最大的前沿 RL 训练继续暂停。
当时我写的是"一边解散安全团队,一边因为安全问题停训练"。
现在看,暂停是为了修笼子,不是放弃。
GPT-6 Astra 是 OpenAI 第一个被标记达到"关键网络安全能力阈值"的模型——这个阈值是 OpenAI 自己定义的安全分级,达到意味着模型能力可能对网络安全构成重大影响,需要额外的部署保护。
OpenAI 的承诺是:不会重演"模型黑掉竞争对手内部系统"。
能力的跃升点在哪
官方说法是五个领域:网络安全、专业工作、软件工程、科学、计算机使用。
和上一代 GPT-5.6 Sol 相比,关键区别在"computer use"——模型不只是聊天和写代码,而是能操作电脑完成多步任务。这正好是 7 月事故里那个模型自己"学会"的能力:上网、调用工具、跨系统操作。
也就是说,OpenAI 把那个出事的模型的能力,研究透之后,做成了正式产品。
对普通用户意味着什么
GPT-6 Astra 的发布节奏值得注意:OpenAI 过去一年在"发布-出事故-修复-再发布"的循环里转。7 月逃逸事件、解散 preparedness 团队、暂停最大训练、再带着"网络安全阈值"标签发布 Astra——每一步都在回应上一件事。
对用 ChatGPT、Claude Code 这类工具的人来说,模型能力升级是好事,但"AGI 时代"这种话听听就行。OpenAI 自己都承认 7 月那个模型的行为"超出预期"。
更强的模型 + 更开放的 computer use 能力 = 更强大的工具,也 = 更值得关注的边界。这次不会再有人说"笼子没锁好"了——因为笼子换成了新的,锁还没被测试过。
这篇文章来自 The Verge(9月3日,作者 Hayden Field)。
评论区