GPT-6 Astra 正式发布:OpenAI 宣告「AGI 时代」,这次 AI 真的开始干活了
OpenAI 发布新一代旗舰模型 GPT-6 Astra:多项基准逼近满分、首次达到「关键级」网络安全门槛,宣告 AI 从「回答问题」走向「替你完成任务」的 AGI 时代。
# GPT-6 Astra 正式发布:OpenAI 宣告「AGI 时代」,这次 AI 真的开始干活了
**分类:AI技术 | 标签:OpenAI, GPT-6, AGI, AI智能体**
一句话前言
北京时间 9 月 4 日凌晨,OpenAI 正式发布新一代旗舰模型 GPT-6 Astra(拉丁语里是「星辰」的意思)。总裁 Greg Brockman 在发布会结尾直接放话:**「欢迎来到 AGI 时代。」** 这两年各家发布会没少吹牛,但这次 Astra 带来的,可能真的不是一次普通升级。
先看成绩单:多项基准逼近满分
OpenAI 把 Astra 定义为一次「代际跃迁」,官方数据也确实夸张:
模型在得州 Stargate 基地用超过 10 万块 GPU 训练,上下文窗口拉到 105 万 token,单次最大输出 12.8 万 token。从数字上看,这已经不是小步快跑,而是直接把天花板捅穿了。
真正的变化:AI 开始「上手干活」了
前几代模型的进步是「更会说话」,Astra 的进步是「更会做事」。它最核心的突破是 **Computer Use(计算机使用)能力成熟**:不再局限于对话框里生成文字,而是能像人一样直接操作屏幕、鼠标和键盘,跨软件完成多步骤工作流。
OpenAI 展示的场景包括:填写美国 1040 报税表、更新 CRM 系统、用 Power BI 做报表、在 KiCad 里做 PCB 布局、用 Unity 搭游戏场景、把 Blender 模型无缝转到虚幻 5……在 OSWorld 2.0 自动化工作流测试里,Astra 用 40 分钟完成任务(上一代要 75 分钟),得分从 65.7% 升到 72.6%;金融建模世界杯挑战中,它用约人类冠军四倍的速度完赛。
一句话:衡量 AI 的标准正在从「能不能生成更好的文字、代码、图片」,转向「能不能独立完成一件完整的工作」。这也是 Brockman 敢提 AGI 的底气——不管你怎么定义 AGI,「数字员工」这个形态是真的来了。
安全是这代最微妙的地方
Astra 是 OpenAI 第一个达到内部 Preparedness Framework「关键级」(Critical)网络安全门槛的模型:已经具备自主发现未知漏洞、开发漏洞利用程序的能力,内部测试中还真的发现并利用了**两个零日漏洞**。
于是 OpenAI 做了个反常的操作:能力最强的部分,限制反而最严。Astra 今天只向参与网络安全项目 Daybreak 的获批企业开放,未来几天才陆续推给 ChatGPT Plus / Pro / Business / Enterprise 用户;最前沿的网络安全能力被单独上了锁。能力越强越要先画清安全边界,这很符合这轮行业风向。
另一个信号:Sam Altman 首次明确表示「一定会做人形机器人」,其世界模拟研究项目也已演变为 OpenAI Robotics。AI 从屏幕里走向物理世界,路径越来越清晰。
价格不便宜,但竞赛已经白热化
Astra 的 API 定价是每百万输入 token 10 美元、输出 50 美元——大约是 GPT-5.6 Sol 的 2.5 倍。贵是真贵,但 OpenAI 的底气在于:它现在是「能干活的模型」,不是「聊天的模型」。
而这几天整个行业都在加速:
大模型竞赛已经从「拼参数、拼榜单」,进入「拼谁能真正替你干活」的阶段。
我的判断
Astra 这次最值得关注的不是分数,而是**产品形态的拐点**:AI 第一次以「数字员工」的身份进入工作流,而不是「助手」。对企业来说,接下来的问题不再是「要不要用 AI」,而是「哪些活可以放心交给 AI、安全边界怎么画」。
当然,「欢迎来到 AGI 时代」这种话,营销成分肯定有——OpenAI 自己都承认,AGI 的定义最终要交给外界判断。但有一点是确定的:**AI 从「会聊天」到「会干活」,这个门槛今天被实质性跨过去了。** 对开发者、对团队、对每个普通用户,都值得认真想想:下一个被 AI 接管的完整工作流,会不会就是你手上那个?