2026 年 9 月 30 日,OpenAI 正式推出了 GPT-6.1 Sol,这是 GPT-6 Sol 的最新升级版。新模型在智能体编程、计算机操作和专业工作等领域的性能几乎达到旗舰模型 GPT-6 Astra,但其标准 API 的输入和输出 Token 费用仅为 Astra 的五分之一。具体定价方面,GPT-6.1 Sol 每百万输入 Token 收费 2 美元,每百万输出 Token 收费 10 美元,保持与 GPT-6 Sol 的一致性;而缓存输入的费用也从每百万 Token 0.20 美元降至 0.10 美元,减少了 50%。对比之下,GPT-6 Astra 的费用分别为每百万输入 10 美元和输出 50 美元。因此, GPT-6.1 Sol 在输入和输出 Token 成本上均是 Astra 的五分之一。在真实代码库复杂软件工程任务的测试中,GPT-6.1 Sol 的表现与 GPT-6 Astra 相同,但任务成本仅为 Astra 的五分之一。同时,模型在性能上也有提高,测试成绩比 GPT-6 Sol 高出 6.4 个百分点,并且推理强度和成本更低。在复杂文档的测试中,GPT-6.1 Sol 的表现亦接近于 GPT-6 Astra,单项任务成本同样显著降低。在 AutomationBench 的测试中,GPT-6.1 Sol 在中等推理强度下超越 Claude Opus 5.5 2.2 个百分点,且任务成本为其三分之一,成绩也比 GPT-6 Sol 高出 4.8 个百分点。电脑操作能力方面,GPT-6.1 Sol 在 OSWorld 2.0 离线测试中表现突出,最高推理强度下成绩比 GPT-6 Sol 高 7 个百分点,接近 GPT-6 Astra,但任务成本却仅为 Astra 的七分之一。尽管在科研领域,GPT-6 Astra 仍然占优,在 Terminal-Bench Science 0.1 测试中,GPT-6.1 Sol 的成绩超越 GPT-6 Sol 的两倍,平均成本为 5.47 美元,而 GPT-6 Astra 的成本为 23.80 美元,且取得 68.1% 的成绩位居首位。OpenAI 建议在最复杂的科研任务中继续采用 Astra。GPT-6.1 Sol 的准确性也有所提高,低推理强度下错误回答比例从 GPT-6 Sol 的 11.4% 降至 7.7%,下降约 32%。在不同推理强度的测试中,二者的事实错误率差距不超过 1.9 个百分点。需要注意的是,该测试是基于用户主动报告的高难度对话,并不代表一般使用时的实际错误率。当前,GPT-6.1 Sol 已对所有 ChatGPT Plus、Pro、Business、Enterprise 和 Edu 用户开放,适用于 ChatGPT Work 和 Codex,但尚未在普通 Chat 模式中使用。开发者也能够通过 OpenAI API 调用 gpt-6.1-sol。OpenAI 还计划在接下来的几天内推出 GPT-6.1 Sol 的 Ultrafast 模式,使得在 Codex 中 Token 的生成速度可达标准模式的 8 倍。