Codex 新功能要来了?OpenAI 新模王Astra 测试也被集中流出

· 2026-08-31 11:02 · 5 阅读

原创 阿雅 2026-08-31 11:02 北京

OpenAI Codex 负责人 Tibo 又又又要准备重置了,并在 X 上喊话:

Codex 和 ChatGPT Work 使用额度将在太平洋时间下午6点重置。大家在重置之前尽可能把现有额度用掉,顺便探索一下最新上线的精彩功能。是时候开启 /fast 模式了

家人们,这次不单单是 OpenAI 又一次给咱们“回血”,Tibo 还专门鼓励大家都开/fast模式把额度烧光,并且去体验最新功能。

没错,就在Tibo宣布重置前,一些Codex用户发现,新的Ultrafast模式似乎已经开始灰度推送。

用户@blueemi99在X上晒出了Codex界面,并询问其他人是否已经获得这一模式。

也是在同一时间前后,X 上突然出现了大量据称由 OpenAI 下一代模型 Astra 生成的测试案例。

更有爆料者称:Astra 可能最快在本周四发布。

如果爆料属实,OpenAI 下一代模型真的已经到了发布前夜。

只是,它会不会叫 GPT-6,目前仍然没有官方答案。

Astra 已经不再是一个传闻模型

今年早些时候,Astra 还只是媒体报道中的一个内部代号。现在,OpenAI 已经公开确认它的存在。

OpenAI 第一次正式介绍 Astra,因为它在安全评估中表现得过于强大,无法排除 Astra 已经达到其网络安全能力标准中的“Critical”级别。

简单来说,它可能不只是帮助安全专家检查漏洞,还可能具备自主发现高价值漏洞、开发攻击手段,甚至执行复杂攻击链的能力。

为此,OpenAI 放慢了部分前沿强化学习工作,并补充模型隔离、网络访问限制、权重保护和推理监控措施。

Sam Altman 随后还表示,Astra 是一个非常强大的模型,OpenAI 正在努力让它能够被广泛使用。

Astra 案例展示

在这次案例展示中,最受关注的案例,是一艘3D科幻飞船:一句话生成3D飞船,半小时输出数万Token

用户给出的要求很简单:

建造一艘华丽的科幻飞船,内部结构可以自由探索。

随后,模型直接生成了一艘拥有完整外观和内部空间的飞船。

它不只是做了一张看起来像飞船的图片,而是同时处理了3D场景、空间结构、内部房间和探索交互。

过去用AI制作类似项目,通常需要人类把任务拆成许多步骤:先生成模型,再设计内部结构,然后编写交互代码,最后反复修改细节。

据发布者展示,Astra尝试把这些工作一次完成。

第二个案例更加夸张。

有人让Astra生成《星球大战》里的死星场景。据测试者自述,模型在Max effort下持续运行约26分钟,一次输出约7.5万Token,最后生成了一个可以交互的完整3D场景。

从视频内容中可以看到,模型生成的不只是死星外观,还包括可操作的3D空间、不同观察视角、场景结构和相应的交互界面。

用户不需要先让模型建立场景,再逐步补充控制代码和交互功能,而是直接给出最终目标,让模型自己完成中间的大量步骤。

第三个案例是一座Voxel风格的立体城堡。

@lyraxana记录,Astra在Max reasoning effort下运行约38分钟,输出约5.6万Token,最终生成了一个带有完整界面的3D宝塔场景。

模型不仅生成了城堡和周围环境,还给项目添加了完整的操作界面。画面中同时存在建筑、场景、菜单和交互按钮,更像一个可以继续开发的游戏原型,而不是单独生成的一张图片。

除了这三个大型案例,还有一些相对简单的测试。

有一些流出的视频则展示了Astra的前端能力:用户只提供一句简单要求,模型便一次生成视觉完成度较高的网页,并主动处理排版、配色、组件和交互细节。

总结一下,我们可以看到这些案例都有一个共同特点:

Astra 在长时间生成、复杂项目完成度和一次性交付规模上有了提升 !

不过,这些视频目前仍然属于社区流出的早期案例。

仅凭几段视频,我们只能看见 Astra 生成了什么,却无法知道 OpenAI 究竟想把它做成什么。

记者Alex Heath看到的内部演示,给出了更完整的答案。

第一,从执行长期任务,走向长期跟进项目

现在的 Codex 已经可以连续工作几天甚至几周,但通常仍要由用户提前设定任务、触发条件和执行时间。

Astra 想再往前一步:不只把任务执行得更久,还要一直保留项目状态。即使中途暂停、出现新资料,或者用户过几天再回来,它也知道项目进行到了哪里,可以接着往下做。

据 Alex Heath 转述:Sam Altman 希望未来能通过ChatGPT或API提供一种可以长期持续运行的智能体。

第二,记住用户的纠正

现在使用 AI 干活,一个常见问题是:

你刚刚纠正了它,换一个任务或者过一段时间,它又犯了同样的错误。

据 Alex Heath 披露,Astra 可以在长期任务中保留人类给出的纠正和反馈。

如果你告诉它,公司报告不能采用某种数据口径,或者代码必须符合一套内部规范,它可以在后续工作中继续遵守,而不是每一次都要重新提醒。

这意味着,未来训练一个 AI 员工可能真的会像带新人一样:

不用每次都重新写提示词,只需要在合作过程中不断纠正,它逐渐适应你的工作方式。

第三,从调用几个助手,走向组织一支 AI 团队

Astra 并不一定独自完成所有工作。

它可以把一个复杂目标拆成多个任务,再让不同智能体分别研究、执行和检查。

比如制作一份公司经营分析:

一个智能体负责整理财务数据,一个负责查找市场信息,一个负责制作图表,另一个负责检查结论是否与原始数字一致。

Astra 更像项目负责人,负责协调这些智能体、合并结果,并判断哪些部分需要重新处理。

这也解释了为什么 OpenAI 越来越强调云端运行。

当一个模型需要连续工作几天,同时调用多个智能体、浏览器、终端和数据工具时,个人笔记本很可能不再是最合适的运行环境。

第四,直接操作桌面软件

Astra 不只生成文字或者代码。

据 Alex Heath 描述,它可以操作桌面软件,制作演示文稿、检查财务材料,并分析格式混乱的数据。

比如它可以从邮件中获取要求,到表格里处理数据,再打开演示软件制作汇报,最后检查结果是否符合最初目标。

过去需要人类不断复制、粘贴和切换窗口的工作,可能被它连接成一条完整流程。

OpenAI 产品负责人还告诉 Alex Heath,为这类持续运行智能体设计的新界面“很快”就会到来。

如果界面已经接近完成,说明 OpenAI 考虑的不只是模型研究,而是普通用户应该如何管理这些不会停止工作的智能体。

一个免费重置,一个开始控制额度

过去几个月,OpenAI 已经多次为 Codex 和 ChatGPT Work 用户重置额度。

这一次,Tibo 甚至直接鼓励用户尽量把额度用光,打开/fast模式,体验最新功能。

其实目标也很明确:先让大家不用心疼Token,敢于把更大、更复杂的任务交给Codex。

当大家习惯让AI连续工作几十分钟、修改多个文件、运行测试并检查结果之后,Codex就不再只是一个偶尔打开的代码助手,而会逐渐进入每天的工作流程。

Astra 也正是使用模式的下一步。

如果一个模型未来需要连续工作几天,协调多个智能体,同时操作浏览器、终端、表格和演示软件,用户消耗的将不再是几次回答,而是持续运行的云端算力。

我们再回头看看隔壁 Anthropic 正在采取另一套策略。

Anthropic最新宣布,从9月14日起,标准周额度将永久提高25%。

和最初的100相比,确实增加了25%;但和用户现在享受的150相比,实际减少了约17%。

这也是不少用户不满的原因。

OpenAI还在频繁重置额度,鼓励用户尽量多用;Anthropic虽然降低了模型单价,却已经开始控制一个包月用户到底可以消耗多少算力。

Astra会不会在本周四发布,目前还没有官宣。

但围绕下一代AI的第一场竞争已经开始了。

不过,看到 Astra 已经展示出的这些能力,我已经忍不住开始期待了!

跳转微信打开