2026 年 7 月 8 日,美国商务部正式撤销对 GPT-5.6 系列模型的临时出口与发布管控。此前因国家安全风险审查,该模型仅向少量白名单企业开放预览。审查结束后,OpenAI 宣布于本周四全量公开发布 Sol、Terra、Luna 三款分层旗舰大模型,并同步上线核心新功能“推理速度手动自定义调节(Speed Dial)”,允许开发者在响应延迟与输出质量之间灵活切换档位。
一、管控解除背景与放行前提
- 管控起因:6 月底,美国政府以防範高级 AI 被用于网络攻击及恶意代码生成为由,强制 OpenAI 暂停全球公开发售,仅允许经审批的合作方内测,并派驻 AI 标准与创新中心团队开展安全压力测试。
- 解禁条件:OpenAI 技术团队驻华盛顿配合完成多轮漏洞核验与风险边界测试,并提交全链路滥用防控方案后,获商务部批准全面放开 API 与 Codex 渠道的全球调用权限。需注意,军事及关键基建领域的定向场景仍保留专项审批限制,并非完全无约束开放。
- 行业联动:此次放行紧随 Anthropic 旗下 Mythos 5、Fable 5 模型管制松绑,标志着美国本轮针对前沿超能力大模型的临时出口审查进入阶段性收尾。
二、GPT-5.6 三款模型定位、定价与核心能力
三款模型均支持 128K 上下文窗口,初期主要面向企业 API 调用,后续将逐步接入 ChatGPT 客户端。核心参数对照如下:
| 模型型号 | 产品定位 | 百万 token 输入/输出单价 | 核心优势&适用场景 | 特色能力 |
|---|---|---|---|---|
| Sol(旗舰版) | 全域最强推理旗舰 | 输入$5、输出$30 | 代码开发、渗透测试、复杂 Agent 任务、科研论文、长文档深度分析 | Ultra 并行子代理模式,Terminal-Bench 编程测试得分 91.9%,居行业第一梯队 |
| Terra(均衡版) | 性价比主力款 | 输入$2.5、输出$15 | 企业日常文案、数据分析、方案撰写、批量业务处理 | 性能对标前代 GPT-5.5 旗舰,定价减半,适合常态化中高并发业务 |
| Luna(轻量极速版) | 低成本高频调用 | 输入$1、输出$6 | 实时对话、智能补全、问答机器人、低延迟接口服务 | 首 token 响应最低可压至 100ms 内,适配 C 端高频轻量化场景 |
三、核心新增:推理速度自定义档位(Speed Dial)
作为 GPT-5.6 系列的标志性工程升级,该功能摒弃了固定推理模式,开放三档可手动切换策略,无需开发者额外搭建路由调度逻辑:
- 低延迟档位(速度优先):优先压缩思考链路,精简中间推理步骤,首个 Token 输出延迟低于 100ms。该模式匹配 Luna 模型,适用于输入法联想、实时客服、弹窗问答等强时效需求场景。
- 标准平衡档位(默认模式):兼顾响应速度与逻辑严谨度,为 Terra 默认启用模式,适配绝大多数办公、内容生成及结构化数据提取业务。
- 深度高质量档位(精度优先):开启多轮自我校验与多路径推理验算,虽增加推理耗时,但大幅降低幻觉与逻辑错误。该模式仅 Sol 旗舰版完整开放,专用于安全审计、法律文书、程序排错等高严谨性工作。
开发者可通过 API 参数直接指定档位,支持单接口动态切换,显著降低 AI 应用的调参运维成本。
四、API 权限与使用规则
- 初期仅通过OpenAI API、Codex 代码接口对外开放,个人版 ChatGPT 接入时间表将另行公示;
- 解除管控后不再限制海外主体申请调用,取消海外客户逐个资质报备流程;
- 新增提示词缓存断点机制,高频重复前缀内容可缓存复用,有效降低大批量调用场景的计费开销。
五、OpenAI 官方立场与后续监管方向
OpenAI CEO 奥尔特曼公开表示,认可阶段性安全审查的必要性,但反对政府长期采用“人工筛选客户”的常态化准入模式。未来公司将推动建立透明、标准化的前沿 AI 发布合规框架。此外,市场传闻公司正与美方磋商出让 5% 股权方案,以换取更稳定宽松的监管环境。
从行业层面看,本次“分级定价 + 速度可调”的产品设计,将算力成本、响应时效、输出质量三个核心变量完全开放给企业自主选型。这一举措将进一步压缩中小 AI 定制模型的生存空间,推动海外 To B 大模型服务向头部集中化发展。

