距离 GPT-5 系列推出一年多后,OpenAI 正式进入 GPT-6 时代,新一代旗舰模型被命名为 GPT-6 Astra

与过去单纯强调推理能力不同,GPT-6 Astra 更明显地面向「AI Agent」和实际工作场景设计。OpenAI 将其定位为目前能力最强、对齐程度最高的模型之一,重点提升了电脑操作、网页浏览、软件工程、网络安全、科学研究以及各种专业工作能力。

GPT-6 Astra 更强调「直接帮你操作电脑」

GPT-6 Astra 一个非常重要的变化,是进一步提升 Computer Use,也就是直接操作电脑和浏览器的能力。

这意味着 ChatGPT 不只是回答问题,而是可以进一步完成多步骤任务,例如打开应用、浏览网页、处理文件,以及制作文档、电子表格和演示文稿。

OpenAI 表示,GPT-6 Astra 针对专业工作环境进行了专门训练,让模型不仅能够理解复杂问题,还能够真正执行完整的工作流程。

在电脑操作方面,GPT-6 Astra 的速度相比此前接近提升 2 倍

与此同时,OpenAI 还对 ChatGPT 背后的执行系统进行了优化。值得注意的是,这部分优化并不局限于 GPT-6 Astra,现有的 GPT-5.6 Sol 同样可以受益,电脑操作任务速度大约可以提升 60%

Codex 获得新的长期上下文机制

GPT-6 Astra 对 Codex 的升级尤其明显。

在大型软件项目中,AI 编程助手经常需要连续工作很长时间。例如调试一个复杂 Bug、重构大型项目或者连续运行大量测试时,模型很容易遇到上下文窗口耗尽的问题。

过去的处理方式通常是 Compaction(上下文压缩)

系统会把此前的大量对话、代码修改和工具调用压缩成一段摘要,然后继续工作。但这种方式存在一个明显问题:压缩过程中可能会丢失细节。

例如:

某个修复方案为什么失败、某个组件有什么特殊行为、之前运行测试得到了什么结果,这些信息可能无法完整保留下来。

GPT-6 Astra 为 Codex 引入了一种新的处理方式。

模型可以在不同上下文窗口之间保存自己的工作笔记,而不是不断把全部历史压缩成一份摘要。

更重要的是,之前的上下文窗口仍然可以被搜索。

也就是说,即使某项需求、测试结果或者工具输出没有进入模型保存的笔记,Astra 仍然能够重新搜索之前的上下文并找回这些信息。

对于持续几个小时甚至更长时间的大型编程任务,这项能力会非常实用。

目前这一功能可以在 Codex 中作为实验功能启用,之后预计会逐步成为 Astra 的默认能力。

软件开发能力进一步增强

OpenAI 将 GPT-6 Astra 称为目前其最强的软件工程模型。

相比传统的「根据提示生成一段代码」,GPT-6 Astra 更强调完整的软件工程流程,包括理解现有项目、修改多个文件、运行工具、测试代码、发现错误,再根据测试结果继续修改。

这也意味着 Codex 的定位正在进一步从「AI 编程助手」转向能够持续执行任务的 Coding Agent

尤其配合新的上下文保存与搜索机制之后,模型在大型代码库和长时间开发任务中的可用性会进一步提升。

数学、科学与网络安全能力同步提升

除了编程和电脑操作,GPT-6 Astra 在多个高难度基准测试上也取得了非常高的成绩。

OpenAI 公布的数据中,GPT-6 Astra 在 FrontierMath Tier 4 上达到 98%,在 ARC-AGI-3 上达到 99.9%,在 ExploitBench 上达到 100%

网络安全能力也是此次升级中特别受到关注的部分。

OpenAI 表示 GPT-6 Astra 的网络安全能力出现了显著跃升,并已经达到其 Preparedness Framework 中的 **Critical(关键)**等级。

也正因为如此,OpenAI 没有一次性向所有用户全面开放 Astra,而是采取更加谨慎的分阶段发布方式。

GPT-6 Astra 开始逐步进入 ChatGPT

GPT-6 Astra 首先向有限数量的组织开放,随后逐步扩大范围。

按照 OpenAI 公布的计划,GPT-6 Astra 将陆续提供给:

ChatGPT Plus、Pro、Business 和 Enterprise 用户,以及 OpenAI API 和 AWS 用户。

Astra 的基础使用量包含在现有订阅额度中,如果超过额度,个人和企业还可以另外购买 Credits。

其中 Pro、Business 和 Enterprise 用户还可以获得更高规格的 GPT-6 Astra Pro

Enterprise 企业管理员则需要主动在 Workspace 中开启 Astra,发布初期默认处于关闭状态。

目前 GPT-6 Astra 已经开始向部分 Business 和 Pro 用户推送,包括每月 100 美元和 200 美元的相关订阅方案,Plus 用户的开放时间相对靠后。

从 GPT-5 到 GPT-6,ChatGPT 的方向正在发生变化

回顾最近一年 OpenAI 的模型更新,可以看到一条越来越清晰的发展路线。

GPT-5 首先引入自动模型路由,让 ChatGPT 可以根据任务自动选择快速回答还是深度推理;之后 GPT-5.4 开始强化超长上下文和电脑操作能力,GPT-5.5 进一步提高自主执行任务的能力,而 GPT-5.6 Sol、Terra 和 Luna 则继续完善不同工作场景。

到了 GPT-6 Astra,这些能力开始真正整合到一个旗舰模型之中。

它的重点已经不只是「回答得更聪明」,而是:

理解任务 → 操作电脑 → 调用工具 → 处理大量上下文 → 执行多步骤流程 → 生成最终工作成果。

特别是电脑操作速度提升、Codex 长期上下文检索以及专业软件工程能力的增强,使 GPT-6 Astra 更接近一个能够长时间独立工作的 AI Agent。