Fazer avançar a fronteira preço-desempenho com GPT‑5.6
Ao tornar cada camada mais eficiente, a OpenAI oferece um melhor desempenho por dólar num maior número de cargas de trabalho empresariais.
Ontem, explicámos como o GPT‑5.6 ajudou a tornar a sua própria execução mais eficiente. Hoje, estamos a transferir esses ganhos para os clientes, com preços mais baixos para o GPT‑5.6 Luna(abre numa nova janela) e Terra(abre numa nova janela) e um desempenho mais rápido com o GPT‑5.6 Sol na API. Em conjunto, estas atualizações ajudam os clientes a obter mais de cada dólar investido em IA e a avançar mais depressa quando o tempo é determinante.
A partir de hoje, o GPT‑5.6 Luna, o nosso modelo mais rápido e económico, custará menos 80%, enquanto o GPT‑5.6 Terra, o nosso modelo equilibrado para o trabalho quotidiano, custará menos 20%. Estes preços mais baixos do Luna e do Terra também se refletem na forma como a utilização é contabilizada nas subscrições pagas ao usar o Codex e o ChatGPT Work. O Luna oferece às empresas uma forma muito mais económica de gerir grandes volumes de trabalho com níveis de qualidade muito elevados. Pode utilizar ferramentas e concluir fluxos de trabalho com várias etapas, tornando viável executar à escala uma gama mais ampla de aplicações de IA.
Tornar a inteligência avançada mais abundante e acessível é fundamental para a missão da OpenAI de garantir que a AGI beneficia toda a humanidade. Estas alterações põem esse compromisso em prática. Refletem anos de melhorias na forma como os nossos modelos são criados, disponibilizados e postos a trabalhar.
Estamos também a introduzir o modo Fast na API, que substitui a nossa oferta Priority Processing. No GPT‑5.6 Sol, o modo Fast oferece agora velocidades até 2,5 vezes superiores às do processamento Standard, pelo dobro do preço e sem qualquer alteração na inteligência. O modo Fast é compatível com versões anteriores: os pedidos marcados como "priority" utilizarão automaticamente o modo Fast.
A utilização eficiente da IA começa pelo resultado. A importância, o custo do erro, a urgência e a escala determinam o equilíbrio certo entre inteligência, velocidade, fiabilidade e custo. Esse equilíbrio pode mudar entre as diferentes etapas de um fluxo de trabalho.
O GPT‑5.6 dá às empresas muito mais margem para otimizar esta equação. O Luna oferece um desempenho comparável ao de modelos que há um ano eram de fronteira, por cerca de 6 cêntimos por cada dólar gasto por tarefa e a uma velocidade quase nove vezes superior. No trabalho profissional, segundo o Agents’ Last Exam, o Luna supera o Fable 5, com um custo estimado por tarefa quase 99% inferior.
Na prática, as empresas podem definir o resultado e o padrão de qualidade de que necessitam e, depois, utilizar avaliações para determinar onde a inteligência adicional melhora substancialmente o resultado e onde um processamento mais rápido e económico pode oferecer a mesma qualidade. Por exemplo, um fluxo de trabalho de programação pode utilizar o Sol para resolver incertezas e definir o plano e, depois, o Luna para implementar alterações bem especificadas, escrever e executar testes e avaliar os resultados. Outro fluxo de trabalho poderá exigir um equilíbrio diferente.
A família GPT‑5.6 amplia o leque dessas opções. As empresas podem aplicar o máximo de inteligência útil em cada etapa, pagando o preço adequado ao valor criado.
Proporcionar essa flexibilidade começa por tornar mais eficiente cada camada subjacente aos modelos.
A nossa vantagem em eficiência resulta da melhoria dos modelos, dos sistemas de inferência que os executam e do harness agêntico que os liga a ferramentas e ao contexto. Os modelos GPT‑5.6 seguem um caminho mais direto na execução do trabalho. Um melhor encaminhamento mantém o hardware produtivo, o software de produção otimizado gera tokens com maior eficiência e uma gestão mais inteligente do contexto ajuda os agentes a evitar repetir trabalho já concluído. Em conjunto, estas melhorias permitem-nos realizar mais trabalho útil com os mesmos recursos computacionais, reduzindo o tempo, os tokens e o custo necessários para cada resultado.
O GPT‑5.6 Sol ajuda-nos cada vez mais a identificar e concretizar a próxima vaga de ganhos. Num processo liderado por pessoas, o Sol reescreveu e otimizou autonomamente kernels de produção, concebeu e executou centenas de experiências para melhorar a geração de tokens e monitorizou o treino, intervindo quando surgiram problemas. O trabalho nos kernels ajudou a reduzir em 20% o custo integral de disponibilização do modelo, enquanto as experiências aumentaram em mais de 15% a eficiência da geração de tokens. Este trabalho prossegue, criando um ciclo de feedback mais estreito: à medida que os nossos modelos melhoram e conseguem trabalhar com maior autonomia, acelera também a nossa capacidade de aumentar a eficiência. Saiba mais sobre a engenharia subjacente ao GPT‑5.6.
Satisfazer a procura de inteligência abundante exige mais capacidade computacional e uma utilização mais produtiva dessa capacidade. Estamos a criar um portefólio de infraestruturas resiliente e a atribuir cada carga de trabalho aos sistemas mais adequados para a executar. Esta abordagem abrange ambas as extremidades da curva preço-desempenho. No lado de menor custo, os novos preços do Luna e do Terra tornam económico o trabalho de grande volume a uma escala muito superior. No lado de fronteira, o modo Fast dá aos clientes da API acesso mais rápido ao Sol quando o tempo de resposta é importante.
As empresas podem integrar mais IA nas operações quotidianas sem sacrificar a velocidade no trabalho de maior importância. A análise documental em larga escala, a classificação de interações com clientes e a implementação de rotina podem tornar-se económicas para utilização generalizada, enquanto as cargas de trabalho complexas do Sol podem avançar mais depressa quando o custo adicional se justifica.
Os ganhos podem acumular-se. Num processo liderado por pessoas, modelos mais capazes ajudam a nossa equipa técnica a encontrar a próxima geração de melhorias, encurtando o caminho para um melhor desempenho e custos mais baixos. A nossa estratégia continua centrada em fazer avançar tanto a capacidade como a eficiência, para que cada geração de inteligência possa realizar mais trabalho a um custo inferior.
O GPT‑5.6 Terra e o Luna continuam disponíveis no ChatGPT Work, no Codex e na API da OpenAI. No ChatGPT Work e no Codex, os utilizadores dos planos Free e ChatGPT Go podem aceder ao Terra, enquanto os utilizadores de ChatGPT Plus, ChatGPT Pro, Business e Enterprise podem escolher entre o Terra e o Luna.
A partir de 30 de julho, na API, o Terra custará 2 USD por milhão de tokens de entrada e 12 USD por milhão de tokens de saída, e o Luna custará 0,20 USD por milhão de tokens de entrada e 1,20 USD por milhão de tokens de saída. O preço do Sol mantém-se inalterado. Os preços das subscrições e os limites de utilização do ChatGPT e do Codex mantêm-se inalterados, enquanto a utilização do Terra e do Luna passa a consumir menos créditos. As alterações de preços começarão a ser implementadas na AWS ainda hoje.
O modo Fast do GPT‑5.6 Sol substitui o Priority Processing na API e fica alinhado com /fast no Codex. Os pedidos existentes à API assinalados como prioritários continuarão a funcionar. Consulte todos os detalhes dos preços da API.


