Conheça o modo Ultrafast: GPT‑5.6 Sol com velocidade até 14× maior
Uma nova categoria de velocidade para Inteligência de ponta, transformando rapidez em vantagem competitiva.
Hoje, apresentamos uma prévia do Ultrafast, um novo nível de serviço que executa o GPT‑5.6 Sol até 14× mais rápido que o processamento padrão e será lançado primeiro na API da OpenAI. Com tecnologia da Cerebras, o Ultrafast gera até 750 tokens de saída por segundo, levando nosso modelo mais inteligente a produtos e fluxos de trabalho em que cada segundo importa.
Com o GPT‑5.6, estamos ampliando a fronteira do que nossos modelos podem fazer e tornando-os mais eficientes em todas as camadas da nossa infraestrutura. Esses avanços tornaram a inteligência avançada mais acessível e mais útil para mais pessoas. Até agora, obter velocidade em tempo real geralmente exigia escolher um modelo menor ou mais especializado. O Ultrafast aponta para o progresso em uma nova direção: mais trabalho útil por segundo.
Quando a velocidade deixa de exigir abrir mão da inteligência, a IA pode chegar às áreas mais sensíveis ao tempo de uma empresa, viabilizando novas formas de trabalho. Já observamos alguns cenários promissores para o Ultrafast:
- Resposta a incidentes e confiabilidade: quando um sistema crítico falhar, analisar logs de aplicações, mudanças recentes no código e relatos de engenheiros para identificar a causa provável e ajudar a preparar uma correção enquanto a interrupção ainda está em andamento.
- Pesquisa financeira e segurança: analisar sinais do mercado, avaliar transações e identificar atividades suspeitas enquanto as condições ainda estão mudando.
- Atendimento ao cliente e voz: resolver problemas complexos dos clientes em tempo real sem interromper a conversa, mesmo quando encontrar a resposta exige várias etapas ou sistemas.
- Comércio: responder a perguntas sobre produtos, verificar o estoque, personalizar recomendações e resolver problemas no checkout enquanto o cliente ainda está decidindo, antes que a hesitação resulte em abandono do carrinho.
- Pesquisa e experimentação ao vivo: transformar pesquisas que antes precisavam ser executadas durante a noite em sessões de trabalho interativas, permitindo que as equipes testem uma ideia, analisem os resultados, ajustem a abordagem e realizem outro experimento sem interromper o ritmo.
Durante o período de prévia, estamos trabalhando com um grupo inicial de clientes para entender onde essa velocidade faz mais diferença e como esse aprendizado pode orientar nossos produtos ao longo do tempo. Se sua empresa precisa de Inteligência de ponta na mais alta velocidade, você pode se cadastrar para receber uma notificação quando o acesso for ampliado.
GPT‑5.6 Sol nos modos Ultrafast e padrão criam, lado a lado, um simulador 3D funcional de armazém a partir do mesmo prompt de texto.
Estamos testando o GPT‑5.6 Sol no modo Ultrafast com um grupo inicial de empresas nas áreas de programação, comércio, pesquisa financeira, atendimento e outras aplicações interativas. Começar pelos fluxos de trabalho empresariais nos permite estudar essas condições em ambientes reais de produção. O trabalho inicial dessas empresas está nos ajudando a entender onde uma mudança de uma ordem de grandeza na velocidade gera mais valor e como os produtos mudam quando o modelo consegue acompanhar o ritmo de quem o utiliza. Usaremos essas descobertas para orientar a implantação à medida que a capacidade aumentar.
Na OpenAI, um grupo de desenvolvedores vem testando o GPT‑5.6 Sol no modo Ultrafast para entender quais fluxos de trabalho se beneficiam da Inteligência de ponta capaz de responder em tempo real.
A resposta a incidentes é um exemplo de uso do Ultrafast pela nossa equipe. Quando um alerta é disparado, os engenheiros precisam formar uma visão precisa enquanto o sistema e as evidências ainda estão mudando. As equipes usam o Ultrafast para ler logs rapidamente, analisar rastreamentos, sintetizar conversas, identificar as próximas verificações e ajudar a preparar ou validar uma correção — tudo em uma fração do tempo e com a inteligência do Sol. Isso reduz o tempo entre observar um sinal, testar uma hipótese e escolher a próxima ação, enquanto os engenheiros continuam responsáveis pelas decisões e pela implantação.
Em pesquisas, nossa equipe usa o Ultrafast para pesquisar rapidamente fontes de conhecimento, consultar dados e coletar, organizar e resumir informações em ferramentas conectadas. Um fluxo de trabalho comum em pesquisa é nossa equipe iniciar um lote de experimentos à noite e analisar os resultados pela manhã. Com o Ultrafast, esse ciclo fica mais curto e passa a permitir várias iterações durante o expediente.
O Ultrafast representa o próximo passo de nossa parceria com a Cerebras para levar inferência de latência ultrabaixa à plataforma da OpenAI. Agora, com o GPT‑5.6 Sol no modo Ultrafast, a Cerebras oferece suporte ao modelo mais inteligente da OpenAI, entregando até 750 tokens de saída por segundo e permitindo que as empresas criem produtos mais responsivos, tomem decisões mais rápidas e integrem uma IA poderosa diretamente aos fluxos de trabalho mais exigentes.
O GPT‑5.6 Sol no modo Ultrafast está disponível hoje em uma prévia limitada para um grupo seleto de clientes. Ampliaremos o acesso à medida que a capacidade aumentar. Cadastre-se para receber novidades.


