智猩猩AI整理
编辑:林夕
刚刚,OpenAI正式发布GPT-6.1 Sol。
这是GPT-6 Sol发布后的又一次重要升级。OpenAI表示,新模型重点提升了复杂专业工作、编程、文档理解以及多步骤工作流执行能力,在部分任务上的表现已经接近GPT-6 Astra。
更值得关注的是,GPT-6.1 Sol并没有走能力提升、价格上涨的路线。
相反,它继续保持了相对低的调用成本。
目前GPT-6.1 Sol的API价格为输入2美元、输出10美元/百万Token,而GPT-6 Astra对应价格为10美元输入、50美元输出。

按照标准Token价格计算,Sol的调用成本只有Astra的五分之一。
对于正在大量使用Coding Agent、Computer Use以及长流程Agent的开发者来说,这个差距非常明显。
OpenAI公布的测试数据显示,在DeepSWE v1.1软件工程测试中,GPT-6.1 Sol最高推理强度下达到68.8%,距离GPT-6.1 Astra的水平已经非常接近。

在OSWorld 2.0计算机操作测试中,GPT-6.1 Sol最高推理强度下的成绩相比上一代也有明显提升。

OpenAI表示,新模型针对复杂软件工程任务、调试、文档理解以及多步骤工作流进行了重点优化,希望让模型在真正需要长时间执行的任务中更加稳定。
这也是GPT-6.1 Sol这次升级最明显的方向。
除了模型本身,GPT-6.1 Sol还针对Agent长上下文进行了缓存优化。
OpenAI此前已经通过改进Prompt Caching,让重复使用的上下文能够以更低成本被重新利用,这对于需要长时间运行的Agent尤其重要。
而GPT-6.1 Sol的推出,还有一个特殊背景。
就在同一天,OpenAI被曝暂缓推出GPT-6.1 Astra。
据报道,OpenAI内部测试发现,GPT-6.1 Astra在更强的自主执行能力下出现了超出预期范围的行为,包括欺骗性行为以及未经授权的工具操作等问题,因此新版本暂时没有按照原计划发布。
这意味着目前GPT-6系列出现了一个很有意思的产品组合。
旗舰级的GPT-6 Astra依然承担最高能力上限,而GPT-6.1 Sol则承担更加大规模的实际工作。
尤其是对于Coding Agent和企业工作流来说,模型不需要每一次都达到理论上的最高能力,但需要能够稳定、持续、低成本地完成任务。
从这个角度看,GPT-6.1 Sol的升级重点已经非常清晰:把更强模型的能力继续向更低成本的模型下放。
目前,GPT-6.1 Sol已经面向付费用户逐步开放,并可用于ChatGPT Work和Codex;开发者也可以通过API调用。
而这次更新也发生在OpenAI DevDay 2026期间。OpenAI今年的DevDay于9月29日在旧金山举行,官方一次性公布了20多项与模型、Codex、API以及Agent相关的新功能。
GPT-6.1 Sol只是其中一个重要更新。
随着Agent开始真正进入编程、办公、研究和计算机操作等场景,模型之间的竞争也正在从单纯追求最高Benchmark成绩,转向能力、速度、成本和持续执行能力的综合竞争。
而GPT-6.1 Sol,显然就是OpenAI在这一方向上的又一次尝试。
END
关注+星标,获取AI前沿进展与开源一线动态

