北京时间 9 月 5 日,OpenAI 正式宣布其新一代旗舰模型GPT-6 Astra面向 ChatGPT Work 和 Codex 中的 Pro、Enterprise 及 Business Premium 用户全面开放,API 同步上线;Plus 和 Business 用户的推送预计将在数日内完成。该模型于 9 月 3 日发布,OpenAI 总裁格雷格·布罗克曼(Greg Brockman)将其定义为“迄今能力最强的模型”,并宣称“欢迎来到 AGI 时代”。
六大领域达到当前最先进水平
官方资料显示,GPT-6 Astra 基于预训练、强化学习与对齐技术的最新突破构建,在计算机操作、网页浏览、软件工程、网络安全、科学研究及通用专业工作六大核心领域均达到业界领先水平。模型支持文本与图像多模态输入,集成网页搜索、文件检索、代码编写与执行等全链路工具。
关键规格方面,该模型拥有105 万 token 的上下文窗口(约等效于 1500 页 A4 纸文本),最大输出长度为 12.8 万 token,知识截止日期更新至 2026 年 4 月 30 日。
评测数据:多项指标近乎满分
OpenAI 公布的基准测试显示,GPT-6 Astra 相较前代模型实现显著跃升:
| 评测项目 | GPT-6 Astra | 对比表现 |
|---|---|---|
| FrontierMath Tier 4(高阶数学) | 97.6% | 接近满分 |
| ARC-AGI-3(陌生环境抽象推理) | 99.9% | 上代 GPT-5.6 Sol 仅为 7.8% |
| ExploitBench(漏洞利用) | 100% | 满分 |
| OSWorld 2.0(计算机操作) | 72.6% | Sol 为 65.7%;任务平均耗时从 75 分钟降至 40 分钟,效率提升约 47% |
尤为引人注目的是 ARC-AGI-3 测试,得分从 7.8% 飙升至 99.9%,该指标被视为衡量模型在陌生环境中进行学习与抽象推理能力的关键标尺。
核心突破:具备自主操作计算机能力
GPT-6 Astra 的核心突破在于计算机操作能力。模型能够自主操控浏览器、办公软件及开发工具,独立完成从资料检索、表格处理到演示文稿制作、代码开发的完整工作流。用户仅需下达宏观指令(如“整理财务分析并制作演示文稿”),模型即可自行拆解任务、调用工具并持续执行。OpenAI 指出,Astra 在遵循现有模板生成高质量幻灯片方面表现卓越。
在网络安全领域,GPT-6 Astra 成为 OpenAI首个达到内部“关键”(Critical)级安全能力门槛的模型。在具备相应工具与权限时,它能在防护严密的系统中自主发现并利用未知漏洞(包括零日漏洞),无需人工逐步指导。鉴于其强大的攻击潜力,OpenAI 采取了谨慎策略,暂不全面开放该能力,并在发布前强化了针对网络滥用及未经授权行为的监控防护。
上线节奏与定价策略
根据发布计划,GPT-6 Astra 首日优先向拥有 Daybreak 专属权限的企业客户开放,随后逐步覆盖 ChatGPT Plus、Pro、Business 与 Enterprise 全系付费用户。API 服务将通过 OpenAI 自营渠道及亚马逊云服务(AWS)Bedrock双路径提供。目前,GPT-6 Pro 用户已可在 ChatGPT 中体验该模型。
商业化定价方面,GPT-6 Astra 的 API 价格为每百万输入 token 10 美元、每百万输出 token 50 美元,约为上一代旗舰 GPT-5.6 Sol 的 2.5 倍,直观体现了其“能力溢价”。
行业意义与理性审视
布罗克曼关于"AGI 时代”的论断,结合高管团队对通用人工智能已至的判断,将 GPT-6 Astra 置于 AGI 叙事的核心。评测数据证实,其在抽象推理(ARC-AGI-3)与计算机操作(OSWorld 2.0)等"AGI 路标”基准上实现了跨越式进展,分别解决了“学会学习”与“动手执行”的关键难题。
然而,OpenAI 在发布中展现出的克制同样值得关注:尽管网络安全能力已达“关键”级别并验证了零日漏洞发现能力,但出于安全边界考量选择暂缓全面开放。对于开发者而言,105 万 token 超长上下文与自主电脑操作的结合,标志着“模型代理完整工作流”正从概念演示走向日常应用;而 2.5 倍的定价涨幅,也引发了业界关于“高性能 AI 实际价值”的深入探讨。
GPT-6 Astra 是否真正开启 AGI 时代尚需时间检验,但“模型自主操作计算机完成任务”已不再是科幻构想,而是触手可及的现实。

