OpenAI 周二发布了两款新模型:GPT-6 Sol 和 GPT-6 Luna。这发生在 Anthropic 推出自己的新旗舰产品 Claude Opus 5.5 几分钟后。

Sol 和 Luna 位于 GPT-6 Astra 之下,该模型在 9 月 3 日推出时被 OpenAI 称为“世界上最智能、最一致的模型”。Astra 仍然是 OpenAI 处理最困难工作的首选; Sol 和 Luna 是为日常工作打造的更便宜、更快的选择。

所以它与 Anthropic 应用的策略非常相似。 Astra相当于Fable,Sol相当于Opus,Terra相当于Sonnet,Luna相当于Haiku(升级后)。

OpenAI 还调整了价格以保持竞争力。与 GPT-5.6 每个代币的促销费率相比,这两种模型的 API 成本降低了 50%。代币是模型读取和写入的文本块,通常比一个完整的单词要少一些,公司按百万付费,因为这就是人工智能账单大规模增加的方式。

欢迎 GPT-6 Sol 和 GPT-6 Luna 来到 GPT-6 宇宙。

GPT-6 Sol 和 Luna 以 GPT-6 Astra 背后的进步为基础,将其大部分优势融入到更快、更实惠的模型中,以支持大规模工作。

我们还使缓存和推理更加高效,并且...... pic.twitter.com/5LiVE4rbFt

- OpenAI (@OpenAI) 2026 年 9 月 22 日

Sol 现在每百万输入代币的成本为 2 美元,每百万输出代币的成本为 10 美元,低于 4 美元和 20 美元。 Luna 从 0.20 美元和 1.20 美元降至 0.10 美元和 0.50 美元。总体而言,与 Anthropic 相比,OpenAI 每层的报价都更便宜。

性能案例依赖于由 Zapier 构建的 AutomationBench 基准,测试人工智能代理是否可以使用涵盖销售、营销、运营、支持、财务和人力资源的 47 种工具执行完整的业务工作流程,并以通过率计分。 GPT-6 Sol 在最高推理设置下得分为 33.2%,每项任务花费 0.27 美元。

根据 OpenAI 自己的数据,Claude Opus 5 在其自己的最高设置下得分为 26.9%,但每项任务的成本却高出 11 倍多。在同一测试中,GPT-6 Sol 还击败了 Anthropic 价格较高的旗舰产品 Claude Fable 5.1。

在 Agents Last Exam 中,该考试评估 AI 代理在 55 个子行业中长期、具有经济价值的工作,并以完成的百分比对结果进行评分,GPT-6 Sol 在其最高努力下得分为 56.4%。 OpenAI 表示,它击败了 Claude Opus 5 的最佳成绩,每项任务的成本降低了 60%。

推理工作是 OpenAI 添加的一个旋钮:将其打开,模型会在回答之前花费更多的时间和计算能力进行双重检查,这往往会同时提高准确性和成本。

对于计算机使用(AI 代理像人一样点击、打字和导航软件),OSWorld 2.0 上的 GPT-6 Sol 几乎与 Claude Opus 5 的中等难度分数持平,为 60.5% 到 60.3%,而成本却低了约 80%。 OSWorld 测试长期、真实的计算机任务,并根据正确完成工作的程度报告部分分数。

GPT-6 Sol 和 Luna 现已在 ChatGPT Work 和 Codex 中为 Plus、Pro、Business、Enterprise 和 Edu 订阅者推出,Luna 还通过桌面应用程序吸引免费和 Go 用户。

这两种模型都还没有出现在普通的 ChatGPT 应用程序中,OpenAI 表示,它正在全天逐步推出这两种模型,以保持服务稳定。