AI 模型
OpenAI 发布 GPT-6 Astra,面向工作与智能体场景的新旗舰模型
OpenAI 推出 GPT-6 Astra,称其在电脑操作、编程、科研、网络安全和专业文档工作流上取得重要进展。
OpenAI 发布 GPT-6 Astra,将其定位为面向专业工作和智能体任务的新一代旗舰模型。OpenAI 新闻页显示,该发布发生在 2026 年 9 月 9 日。模型页面称,Astra 会先面向一批有限组织开放,随后在未来几天内提供给 ChatGPT Plus、Pro、Business 和 Enterprise 用户,并通过 OpenAI API、Microsoft Azure 与 AWS Bedrock 向开发者开放。
这次发布并不只是一次聊天机器人升级。OpenAI 把 Astra 描述为能承担更长、更复杂工作流的系统,结合了预训练、强化学习和对齐方面的多年进展。官方称,Astra 在电脑操作、浏览、软件工程、网络安全、科学和专业任务上达到前沿水平,并在 FrontierMath Tier 4、ARC-AGI-3、ExploitBench 等评测中取得很高成绩。与此同时,OpenAI 也强调生产环境中的安全防护会限制某些高风险能力的使用方式。
电脑操作是这次发布的核心。OpenAI 表示,Astra 能更快、更准确地操作软件和网页,处理填写表单、更新 CRM 记录、整理日程、在线研究,以及在邮件或文档工具中生成摘要等任务。模型页面还提到,在 OSWorld 2.0 延迟模拟中,Astra 相比 GPT-5.6 Sol 以更短时间完成更高表现的电脑操作任务;Codex harness 的更新也会配合模型能力,提高编程和网页操作任务的完成速度。
Astra 同时被推向专业交付物场景。OpenAI 称它更擅长遵循既有模板,生成结构清晰的文档、表格和演示文稿,并只提取完成任务真正需要的上下文。这反映出 AI 产品竞争正在从纯粹的 benchmark 分数,转向模型能否产出符合企业标准、减少人工返工的结果。
网络安全是发布中最敏感的部分。OpenAI 称 Astra 的网络能力明显提升,并达到其 Preparedness Framework 下的 Critical 阈值。公司表示,该模型在漏洞利用开发和逆向工程评测中表现突出,在评估过程中还发现了两个此前未知的零日漏洞,OpenAI 称正在向维护者披露。与此同时,正式推出的版本会拒绝更高级的进攻性网络安全请求,但支持安全代码审查和补丁修复等防御任务。
OpenAI 也把这次产品发布与对齐能力放在一起讲述。公司称 Astra 是其当前最对齐的模型,并介绍了用于评估模型是否会超出任务授权范围的新测试。真正的考验会出现在规模化使用之后:当更多用户把开放式工作交给模型,安全边界、任务理解和工具操作的稳定性都要经受现实场景检验。Astra 的发布说明,前沿 AI 竞争正进入一个更偏向智能体执行的阶段。