Antevisão do modo Ultrafast: GPT‑5.6 Sol até 14× mais rápido
Uma nova classe de velocidade para a inteligência de fronteira, transformando a rapidez numa vantagem competitiva.
Hoje, apresentamos uma antevisão do Ultrafast, uma nova Camada de serviço que executa o GPT‑5.6 Sol até 14× mais depressa do que o processamento Standard e que será lançada primeiro na API da OpenAI. Com tecnologia da Cerebras, o Ultrafast gera até 750 tokens de saída por segundo, levando o nosso modelo mais inteligente a produtos e fluxos de trabalho em que cada segundo conta.
Com o GPT‑5.6, estamos a alargar os limites do que os nossos modelos conseguem fazer e a torná-los mais eficientes em todas as camadas da nossa infraestrutura. Estas melhorias tornaram a inteligência avançada mais acessível e mais útil para mais pessoas. Até agora, obter velocidade em tempo real implicava normalmente escolher um modelo mais pequeno ou mais especializado. O Ultrafast aponta para o progresso numa nova direção: mais trabalho útil por segundo.
Quando a velocidade deixa de exigir que se abdique da inteligência, a IA pode integrar as áreas mais urgentes de uma empresa e viabilizar novos tipos de trabalho. Já identificámos alguns cenários promissores para o Ultrafast:
- Resposta a incidentes e fiabilidade: quando um sistema crítico falha, analisar registos de aplicações, alterações recentes ao código e relatórios de engenheiros para identificar a causa provável e ajudar a preparar uma correção enquanto a interrupção ainda está em curso.
- Investigação financeira e segurança: analisar sinais do mercado, avaliar transações e identificar atividades suspeitas enquanto as condições continuam a mudar.
- Apoio ao cliente e voz: resolver problemas complexos dos clientes em tempo real sem interromper a conversa, mesmo quando encontrar a resposta exige vários passos ou sistemas.
- Comércio: responder a perguntas sobre produtos, verificar o inventário, personalizar recomendações e resolver problemas no pagamento enquanto o cliente ainda está a decidir, antes que a hesitação resulte num carrinho abandonado.
- Investigação e experimentação em tempo real: transformar uma investigação que antes demorava uma noite inteira numa sessão de trabalho interativa, permitindo às equipas testar uma ideia, examinar os resultados, ajustar a abordagem e realizar outra experiência sem perder o ritmo.
Durante o período de antevisão, estamos a trabalhar com um grupo inicial de clientes para perceber onde esta velocidade faz maior diferença e como essas aprendizagens podem orientar os nossos produtos ao longo do tempo. Se a sua empresa precisa de inteligência de fronteira à máxima velocidade, pode registar-se para receber uma notificação quando o acesso for alargado.
O GPT‑5.6 Sol nos modos Ultrafast e Standard cria, lado a lado, um simulador funcional de um armazém 3D a partir do mesmo prompt de texto.
Temos testado o GPT‑5.6 Sol no modo Ultrafast com um grupo inicial de empresas nas áreas de programação, comércio, investigação financeira, apoio ao cliente e outras aplicações interativas. Começar por fluxos de trabalho empresariais permite-nos estudar estas condições em ambientes reais de produção. O trabalho inicial destas empresas está a ajudar-nos a perceber onde uma mudança de uma ordem de grandeza na velocidade gera mais valor e como os produtos mudam quando o modelo consegue acompanhar a pessoa que o utiliza. Usaremos estas conclusões para orientar a implementação à medida que a capacidade aumentar.
Na OpenAI, um grupo de programadores tem testado o GPT‑5.6 Sol no modo Ultrafast para perceber que fluxos de trabalho beneficiam de inteligência de fronteira capaz de responder em tempo real.
A resposta a incidentes é um dos casos em que a nossa equipa utiliza o Ultrafast. Quando é acionado um alerta, os engenheiros têm de formar uma imagem rigorosa da situação enquanto o sistema e os dados disponíveis continuam a mudar. As equipas utilizam-no para ler rapidamente registos, analisar rastreios, sintetizar conversas, identificar as verificações seguintes e ajudar a preparar ou validar uma correção — tudo numa fração do tempo e com a inteligência do Sol. Reduz o tempo entre observar um sinal, testar uma hipótese e escolher a ação seguinte, mantendo os engenheiros responsáveis pelas decisões e pela implementação.
Na investigação, a nossa equipa utiliza o Ultrafast para pesquisar rapidamente fontes de conhecimento, consultar dados e recolher, organizar e resumir informação através de ferramentas ligadas entre si. Um fluxo de trabalho comum na investigação consiste em os membros da nossa equipa iniciarem um conjunto de experiências durante a noite e analisarem os resultados de manhã. Com o Ultrafast, este ciclo torna-se mais curto, permitindo realizar várias iterações durante o dia de trabalho.
O Ultrafast representa o próximo passo na nossa parceria com a Cerebras para levar inferência de latência ultrabaixa à plataforma da OpenAI. Agora, com o GPT‑5.6 Sol no modo Ultrafast, a Cerebras suporta o modelo mais inteligente da OpenAI, fornecendo até 750 tokens de saída por segundo e permitindo às empresas criar produtos mais responsivos, tomar decisões mais rápidas e integrar IA poderosa diretamente nos seus fluxos de trabalho mais exigentes.
O GPT‑5.6 Sol no modo Ultrafast está hoje disponível numa antevisão limitada para um grupo selecionado de clientes. Alargaremos o acesso à medida que a capacidade aumentar. Registe-se para receber novidades.


