OpenAI 发布了什么
The Verge 于 2026 年 9 月 3 日报道,OpenAI 已发布 GPT-6 Astra,公司总裁 Greg Brockman 将这次发布描述为进入 AGI 时代。这是公司高管的主张,并非经过独立确认的技术门槛。OpenAI 开发者文档提供了更具体的定位:Astra 是其面向复杂推理、编程、计算机操作、研究和文档创建的能力最强模型。
API 模型页面列出 1,050,000 token 的上下文窗口和 128,000 token 的最大输出。Astra 接受文本和图像输入,并可通过 Responses API 使用托管工具。OpenAI 表示访问权限正在逐步开放,因此发布初期的可用性可能因套餐、组织和地区而异。
面向长流程的功能
Astra 最重要的变化既涉及模型能力,也涉及流程编排。异步工具调用允许应用在外部工具仍运行时继续处理其他工作。中途引导让用户能在回复进行中补充或更正指令。配置更新还可在不改写早期提示前缀的情况下,调整对话中的推理强度。
对开发者而言,这些功能可减少跨浏览器、代码和企业软件运行的智能体反复停止与重启。不过,状态管理也变得更重要:应用仍需跟踪待完成工具调用、保留标识符,并决定迟到的工具结果如何影响已经完成的工作。OpenAI 建议 Astra 的工具调用使用 Responses API。
模型支持 low、medium、high、xhigh 和 max 推理等级。文档称它不支持 none;采用欧盟数据驻留时也不能使用快速处理。官方公布的每 token 价格高于较低层级模型,因此团队应在自己的工作负载上评估任务完成率、token 用量和延迟,而不是仅凭单项基准判断价值。
安全监控改变运行方式
OpenAI 表示,Astra 增加了针对潜在不一致行为的异步监控。API 可提供安全警报记录,指出可能非预期的数据访问、数据传输或破坏性活动,并说明请求是否被暂停。因此,生产集成需要在监控中断流程时提供审查和恢复路径。被暂停的请求不应被当作普通网络错误直接重试。
这一保护措施很重要,因为能力更强的智能体可接触更多系统,并在更长任务中保持状态。它仍不能代替开发者限制权限、验证工具输入、让敏感操作保持可逆,以及在后果重大时设置人工审查。
团队应该测试什么
考虑采用 Astra 的团队应先测试有代表性的端到端任务,而不是孤立提示。评估项可包括完成质量、工具调用准确性、收到中途更正后的行为、迟到结果的处理、安全中断及每项已完成任务的总成本。OpenAI 还表示,该模型对 skills 和代码仓库指南中的指令更敏感,现有提示可能需要调整。
这次发布扩大了单一模型能够协调的工作范围,但实际价值仍取决于应用能否可靠地约束和观察这种协调。