Saltar para o conteúdo principal
OpenAI

13 de agosto de 2026

Produto

Antevisão do modo Ultrafast: GPT‑5.6 Sol até 14× mais rápido

Uma nova classe de velocidade para a inteligência de fronteira, transformando a rapidez numa vantagem competitiva.

A carregar…

Hoje, apresentamos uma antevisão do Ultrafast, uma nova Camada de serviço que executa o GPT‑5.6 Sol até 14× mais depressa do que o processamento Standard e que será lançada primeiro na API da OpenAI. Com tecnologia da Cerebras, o Ultrafast gera até 750 tokens de saída por segundo, levando o nosso modelo mais inteligente a produtos e fluxos de trabalho em que cada segundo conta.

Com o GPT‑5.6, estamos a alargar os limites do que os nossos modelos conseguem fazer e a torná-los mais eficientes em todas as camadas da nossa infraestrutura. Estas melhorias tornaram a inteligência avançada mais acessível e mais útil para mais pessoas. Até agora, obter velocidade em tempo real implicava normalmente escolher um modelo mais pequeno ou mais especializado. O Ultrafast aponta para o progresso numa nova direção: mais trabalho útil por segundo.

Quando a velocidade deixa de exigir que se abdique da inteligência, a IA pode integrar as áreas mais urgentes de uma empresa e viabilizar novos tipos de trabalho. Já identificámos alguns cenários promissores para o Ultrafast:

  • Resposta a incidentes e fiabilidade: quando um sistema crítico falha, analisar registos de aplicações, alterações recentes ao código e relatórios de engenheiros para identificar a causa provável e ajudar a preparar uma correção enquanto a interrupção ainda está em curso.
  • Investigação financeira e segurança: analisar sinais do mercado, avaliar transações e identificar atividades suspeitas enquanto as condições continuam a mudar.
  • Apoio ao cliente e voz: resolver problemas complexos dos clientes em tempo real sem interromper a conversa, mesmo quando encontrar a resposta exige vários passos ou sistemas.
  • Comércio: responder a perguntas sobre produtos, verificar o inventário, personalizar recomendações e resolver problemas no pagamento enquanto o cliente ainda está a decidir, antes que a hesitação resulte num carrinho abandonado.
  • Investigação e experimentação em tempo real: transformar uma investigação que antes demorava uma noite inteira numa sessão de trabalho interativa, permitindo às equipas testar uma ideia, examinar os resultados, ajustar a abordagem e realizar outra experiência sem perder o ritmo.

Durante o período de antevisão, estamos a trabalhar com um grupo inicial de clientes para perceber onde esta velocidade faz maior diferença e como essas aprendizagens podem orientar os nossos produtos ao longo do tempo. Se a sua empresa precisa de inteligência de fronteira à máxima velocidade, pode registar-se para receber uma notificação quando o acesso for alargado.

O GPT‑5.6 Sol nos modos Ultrafast e Standard cria, lado a lado, um simulador funcional de um armazém 3D a partir do mesmo prompt de texto.

A experiência dos primeiros clientes

Temos testado o GPT‑5.6 Sol no modo Ultrafast com um grupo inicial de empresas nas áreas de programação, comércio, investigação financeira, apoio ao cliente e outras aplicações interativas. Começar por fluxos de trabalho empresariais permite-nos estudar estas condições em ambientes reais de produção. O trabalho inicial destas empresas está a ajudar-nos a perceber onde uma mudança de uma ordem de grandeza na velocidade gera mais valor e como os produtos mudam quando o modelo consegue acompanhar a pessoa que o utiliza. Usaremos estas conclusões para orientar a implementação à medida que a capacidade aumentar.

1 de 4
O aumento de velocidade proporcionado pela Cerebras é impressionante. Permite utilizar os modelos de novas formas e torna viável que os programadores trabalhem com eles de forma mais focada e produtiva.
—John Crepezzi, assistentes de IA, Jane Street

Como a OpenAI utiliza o Ultrafast

Na OpenAI, um grupo de programadores tem testado o GPT‑5.6 Sol no modo Ultrafast para perceber que fluxos de trabalho beneficiam de inteligência de fronteira capaz de responder em tempo real.

A resposta a incidentes é um dos casos em que a nossa equipa utiliza o Ultrafast. Quando é acionado um alerta, os engenheiros têm de formar uma imagem rigorosa da situação enquanto o sistema e os dados disponíveis continuam a mudar. As equipas utilizam-no para ler rapidamente registos, analisar rastreios, sintetizar conversas, identificar as verificações seguintes e ajudar a preparar ou validar uma correção — tudo numa fração do tempo e com a inteligência do Sol. Reduz o tempo entre observar um sinal, testar uma hipótese e escolher a ação seguinte, mantendo os engenheiros responsáveis pelas decisões e pela implementação.

Na investigação, a nossa equipa utiliza o Ultrafast para pesquisar rapidamente fontes de conhecimento, consultar dados e recolher, organizar e resumir informação através de ferramentas ligadas entre si. Um fluxo de trabalho comum na investigação consiste em os membros da nossa equipa iniciarem um conjunto de experiências durante a noite e analisarem os resultados de manhã. Com o Ultrafast, este ciclo torna-se mais curto, permitindo realizar várias iterações durante o dia de trabalho.

Com tecnologia da Cerebras

O Ultrafast representa o próximo passo na nossa parceria com a Cerebras para levar inferência de latência ultrabaixa à plataforma da OpenAI. Agora, com o GPT‑5.6 Sol no modo Ultrafast, a Cerebras suporta o modelo mais inteligente da OpenAI, fornecendo até 750 tokens de saída por segundo e permitindo às empresas criar produtos mais responsivos, tomar decisões mais rápidas e integrar IA poderosa diretamente nos seus fluxos de trabalho mais exigentes.

Disponibilidade

O GPT‑5.6 Sol no modo Ultrafast está hoje disponível numa antevisão limitada para um grupo selecionado de clientes. Alargaremos o acesso à medida que a capacidade aumentar. Registe-se para receber novidades.