OpenAI 正式公布全新模型 GPT-6 Astra,声称其为全球最具智能且对齐程度最高的系统。Astra 整合多年在预训练、强化学习及对齐研究方面的大规模投入,在电脑操作、浏览器使用、软件工程、网络安全、科学研究及专业工作领域均达到业内领先水平。在 FrontierMath Tier 4 基准测试中,Astra 取得 98 分的成绩,并已协助解决多个长期悬而未决的数学难题;同时在 ARC-AGI-3 测试取得 99.9 分,在 ExploitBench 取得 100 分的满分成绩。
Astra 在电脑操作方面表现突出,能在用户于 Mac 或其他桌面设备工作期间,在后台执行复杂任务。OpenAI 指出,模型结合了解决复杂问题所需的智能,以及执行多步骤工作流程并产出完善文件、试算表及简报的能力。Astra 亦被誉为目前软件工程领域表现最佳的模型。在 Codex 方面,Astra 引入全新的上下文管理机制,当上下文窗口填满时能保留并检索过往对话记录,解决传统压缩方式可能遗漏修正失败原因或组件运作细节的问题。
此实验功能现已开放启用,未来数周将成为 Astra 的默认选项。
Astra 于网络安全领域达到关键门槛
OpenAI 强调,Astra 在网络安全能力方面实现重大跃进,符合该公司 Preparedness Framework 框架下所制定的“关键”门槛。基于安全考量,模型将以较缓慢的速度向用户推出。Astra 今日起率先向部分机构开放,未来数日内将陆续供所有 ChatGPT Plus、Pro、Business 及 Enterprise 用户使用,并通过 OpenAI API 及 AWS 提供服务。
Astra 的用量计入现有订阅额度内,用户及企业另可购买额外点数。Pro、Business 及 Enterprise 方案的用户更可使用 GPT-6 Astra Pro 版本;企业管理员可为其工作空间启用 Astra,默认状态为关闭。
从 GPT-5 至 GPT-6 的演进历程
GPT-5 于 2025 年 8 月 7 日推出,取代 GPT-4o 及多个推理模型,成为 ChatGPT 的默认模型。其核心特色为自动路由功能,ChatGPT 会根据需求即时回应或启动深度推理。OpenAI 同时宣称其事实错误较 GPT-4o 有所减少。Apple 于 iOS 26、iPadOS 26 及 macOS Tahoe 26 中采用该模型,ChatGPT 请求通过 Apple Intelligence 处理,包括 Siri 交接、写作工具及视觉智能等功能,均由 GPT-4o 转为使用 GPT-5。同年 11 月推出的 GPT-5.1 提供更温暖自然的回应;12 月因应 Gemini 竞争,内部发出“红色警报”后加速推出 GPT-5.2,以强化专业工作表现。其后推出的 GPT-5.3 Instant 针对 ChatGPT 被诟病的“尴尬”语气进行调整,两日后再发布配备一百万 tokens 上下文窗口及内建电脑操作功能的 GPT-5.4 Thinking。
OpenAI 此后陆续推出 GPT-5.4 mini 与 nano 轻量版本、设有限制的 GPT-5.4-Cyber、用于更自主工作的 GPT-5.5、GPT-5.5 Instant,以及 7 月份的 GPT-5.6 Sol、Terra 及 Luna 系列模型。软件配套方面,OpenAI 于 2 月推出独立的 Codex Mac 应用程序,作为执行多个编码代理、审核变更及排程工作的中枢。
7 月时,Codex 实际上取代原有 ChatGPT 桌面应用程序,整合 Chat、Work 及 Codex 功能,原生客户端则改名为 ChatGPT Classic。OpenAI 表示,最新 GPT-6 模型初期仅供其网络安全导向的 Daybreak 计划成员使用,此发布节奏与上代 GPT-5.6 的安排相若。

