跳至主要内容
OpenAI

2026年7月30日

产品

以 GPT‑5.6 推进性价比前沿

通过提高每一层的效率,OpenAI 正在为更多企业工作负载带来更高的单位成本性能。

正在加载…

昨天,我们介绍了 GPT‑5.6 如何帮助自身提高运行效率。今天,我们将这些收益回馈给客户:降低 API 中 GPT‑5.6 Luna(在新窗口中打开)Terra(在新窗口中打开) 的价格,并提升 GPT‑5.6 Sol 的性能速度。这些更新共同帮助客户提高每一美元 AI 投资的回报,并在时间紧迫时更快推进工作。

从今天起,我们速度最快、价格最低的模型 GPT‑5.6 Luna 将降价 80%;兼顾各方面、适合日常工作的 GPT‑5.6 Terra 将降价 20%。在 Codex 和 ChatGPT 工作中使用 Luna 和 Terra 时,付费订阅的用量计算方式也会相应体现此次降价。Luna 为企业提供了一种更具成本效益的方式,能够以极高质量处理大批量工作。它可以使用工具并完成多步骤工作流,让更多 AI 应用能够切实实现规模化运行。

让先进智能更加充裕且普惠,是 OpenAI 确保 AGI 惠及全人类这一使命的核心。这些调整将这一承诺付诸实践。它们体现了我们多年来在模型构建、部署服务和实际应用方面取得的改进。

我们还将在 API 中推出快速模式,以取代“优先处理”服务。对于 GPT‑5.6 Sol,快速模式现在能以标准处理两倍的价格提供最高 2.5 倍的速度,同时智能水平保持不变。快速模式向后兼容:标记为 priority 的请求将自动使用快速模式。

1 条/ 共 6 条
GPT‑5.6 Luna 让我们前所未有地接近“智能成本低到无需计量”的愿景。我从未见过价格如此低廉却又如此强大的模型——它正在帮助 Replit 解锁一些我们原以为很久以后才会开发的用例。
Michele Catasta,Replit 总裁兼 AI 负责人

让智能水平与成果相匹配

高效使用 AI,要从预期成果出发。任务的重要程度、出错成本、紧迫性和规模,决定了智能、速度、可靠性与成本之间的适当平衡。这种平衡可能随工作流中的不同步骤而变化。

GPT‑5.6 为企业优化这一平衡提供了更大空间。Luna 的性能可媲美一年前的前沿模型,但每项任务的成本仅约为其 6%,速度则接近其九倍。根据 Agents’ Last Exam 对专业工作的评测,Luna 的表现优于 Fable 5,预计每项任务的成本低近 99%。

在实践中,企业可以先明确所需成果和质量标准,再通过评估判断哪些环节增加智能水平能显著改善结果,以及哪些环节可以使用速度更快、成本更低的处理方式达到同等质量。例如,编码工作流可以先使用 Sol 消除不确定性并制定计划,再使用 Luna 实施定义明确的变更、编写并运行测试,以及评估结果。其他工作流可能需要不同的平衡。

GPT‑5.6 系列进一步拓宽了这些选择。企业可以在每个阶段运用最具实用价值的最高智能水平,并为其创造的价值支付合理价格。

要实现这种灵活性,首先要提高模型背后每一层的效率。

我们如何推进效率前沿

我们的效率优势来自对模型、运行模型的推理系统,以及将模型与工具和上下文相连接的智能体执行框架的持续改进。GPT‑5.6 模型能以更直接的方式完成工作。更好的路由机制让硬件保持高效利用,经过优化的生产软件能更高效地生成 Token,而更智能的上下文管理则帮助智能体避免重复已完成的工作。这些改进共同帮助我们用相同的算力完成更多有价值的工作,减少取得每项成果所需的时间、Token 和成本。

GPT‑5.6 Sol 正越来越多地帮助我们发现并实现下一轮效率提升。在由人主导的流程中,Sol 自主重写并优化了生产内核,设计并运行了数百项实验以改进 Token 生成,还会监控训练并在出现问题时介入。内核方面的工作帮助模型端到端服务成本降低了 20%,相关实验则将 Token 生成效率提高了 15% 以上。这项工作仍在继续,并形成更紧密的反馈循环:随着模型不断改进并能更自主地工作,我们提升效率的速度也随之加快。详细了解 GPT‑5.6 背后的工程技术。

面向规模化需求的算力战略

满足对充裕智能的需求,既需要更多算力,也需要提高算力产出。我们正在构建具有韧性的基础设施组合,并为每项工作负载匹配最适合运行它的系统。这种方法能够兼顾性价比曲线的两端。在低成本端,Luna 和 Terra 的新价格让大批量工作能以经济可行的方式实现更大规模运行。在前沿端,响应时间至关重要时,快速模式让 API 客户能够更快地使用 Sol。

企业可以将更多 AI 引入日常运营,同时不牺牲最关键工作所需的速度。大规模文档分析、客户互动分类和常规实施工作可以更经济地广泛运行;对于复杂的 Sol 工作负载,如果额外成本合理,则可以更快处理。

这些收益可以不断叠加。在由人主导的流程中,能力更强的模型可以帮助我们的技术团队发现新一代改进,缩短实现更高性能和更低成本的路径。我们的战略仍将专注于同步提升能力与效率,让每一代智能都能以更低成本完成更多工作。

可用性与定价

GPT‑5.6 Terra 和 Luna 将继续在 ChatGPT 工作、Codex 和 OpenAI API 中提供。在 ChatGPT 工作和 Codex 中,Free 和 ChatGPT Go 用户可以使用 Terra;ChatGPT Plus、ChatGPT Pro、Business 和 Enterprise 用户可以选择 Terra 和 Luna。

自 7 月 30 日起,Terra 的 API 价格为每百万输入 Token 2 美元、每百万输出 Token 12 美元;Luna 则为每百万输入 Token 0.20 美元、每百万输出 Token 1.20 美元。Sol 的价格保持不变。ChatGPT 和 Codex 的订阅价格与配额预算保持不变,但使用 Terra 和 Luna 现在会消耗更少的额度。定价调整将于今天晚些时候开始在 AWS 中逐步推出。

GPT‑5.6 Sol 的快速模式将在 API 中取代“优先处理”,并与 Codex 中的 /fast 保持一致。现有标记为 priority 的 API 请求将继续正常工作。查看完整的 API 定价详情。

作者

OpenAI