Avance del modo Ultrarrápido: GPT‑5.6 Sol, hasta 14 veces más rápido
Una nueva categoría de velocidad para la inteligencia de vanguardia que convierte la rapidez en una ventaja competitiva.
Hoy presentamos un avance de Ultrarrápido, un nuevo nivel de servicio que ejecuta GPT‑5.6 Sol hasta 14 veces más rápido que el procesamiento Estándar y que se lanzará primero en la API de OpenAI. Con tecnología de Cerebras, Ultrarrápido genera hasta 750 tokens de salida por segundo, lo que permite llevar nuestro modelo más inteligente a productos y flujos de trabajo donde cada segundo cuenta.
Con GPT‑5.6, ampliamos la frontera de lo que nuestros modelos pueden hacer y los hacemos más eficientes en cada capa de nuestra infraestructura. Estas mejoras han hecho que la inteligencia avanzada sea más asequible y más útil para más personas. Hasta ahora, alcanzar velocidades en tiempo real solía implicar elegir un modelo más pequeño o especializado. Ultrarrápido marca el progreso en una nueva dirección: más trabajo útil por segundo.
Cuando la velocidad ya no exige sacrificar inteligencia, la IA puede integrarse en las áreas de una empresa donde el tiempo es más crítico y hacer posibles nuevas formas de trabajo. Ya hemos identificado algunos escenarios prometedores para Ultrarrápido:
- Respuesta a incidentes y confiabilidad: cuando falla un sistema crítico, analiza registros de aplicaciones, cambios de código recientes e informes de ingeniería para identificar la causa probable y ayudar a preparar una solución mientras la interrupción sigue en curso.
- Investigación financiera y seguridad: analiza señales del mercado, evalúa transacciones e identifica actividades sospechosas mientras las condiciones siguen cambiando.
- Atención al cliente y voz: resuelve problemas complejos de los clientes en tiempo real sin interrumpir la conversación, incluso cuando encontrar la respuesta requiere varios pasos o sistemas.
- Comercio: responde preguntas sobre productos, revisa el inventario, personaliza recomendaciones y resuelve problemas con el pago mientras el comprador aún está decidiendo, antes de que la duda se convierta en un carrito abandonado.
- Investigación y experimentación en vivo: convierte una investigación que antes requería ejecutarse durante toda la noche en una sesión de trabajo interactiva, donde los equipos pueden probar una idea, examinar los resultados, ajustar su enfoque y realizar otro experimento sin interrumpir su ritmo.
Durante el periodo de vista previa, trabajamos con un grupo inicial de clientes para comprender dónde esta velocidad marca la mayor diferencia y cómo esos aprendizajes pueden orientar nuestros productos con el tiempo. Si tu empresa necesita inteligencia de vanguardia a la máxima velocidad, puedes registrarte para recibir una notificación cuando se amplíe el acceso.
GPT‑5.6 Sol en los modos Ultrarrápido y Estándar crea, en paralelo, un simulador de almacén 3D funcional a partir del mismo prompt de texto.
Hemos probado GPT‑5.6 Sol en modo Ultrarrápido con un grupo inicial de empresas dedicadas a la programación, el comercio, la investigación financiera, la atención al cliente y otras aplicaciones interactivas. Comenzar con flujos de trabajo empresariales nos permite estudiar estas condiciones en entornos de producción reales. Sus primeras experiencias nos ayudan a comprender dónde un salto de velocidad de un orden de magnitud genera más valor y cómo cambian los productos cuando el modelo puede seguir el ritmo de quien lo usa. Usaremos estos hallazgos para orientar la implementación a medida que aumente la capacidad.
En OpenAI, un grupo de desarrolladores ha probado GPT‑5.6 Sol en modo Ultrarrápido para comprender qué flujos de trabajo se benefician de una inteligencia de vanguardia capaz de responder en tiempo real.
La respuesta a incidentes es uno de los casos en los que nuestro equipo usa Ultrarrápido. Cuando se activa una alerta, los ingenieros deben construir una imagen precisa mientras el sistema y la evidencia siguen cambiando. Los equipos lo usan para leer registros rápidamente, analizar trazas, sintetizar conversaciones, identificar las próximas verificaciones y ayudar a preparar o validar una solución, todo en una fracción del tiempo y con la inteligencia de Sol. Reduce el tiempo entre observar una señal, probar una hipótesis y elegir la siguiente acción, mientras los ingenieros conservan la responsabilidad sobre el criterio y la implementación.
Para la investigación, nuestro equipo usa Ultrarrápido a fin de consultar rápidamente fuentes de conocimiento y datos, además de recopilar, organizar y resumir información de herramientas conectadas. Un flujo de trabajo habitual de nuestro equipo de investigación consiste en iniciar una serie de experimentos por la noche y revisar los resultados por la mañana. Con Ultrarrápido, vemos que este ciclo se acorta y permite realizar varias iteraciones durante la jornada laboral.
Ultrarrápido marca el siguiente paso de nuestra alianza con Cerebras para llevar la inferencia de latencia ultrabaja a la plataforma de OpenAI. Ahora, con GPT‑5.6 Sol en modo Ultrarrápido, Cerebras impulsa el modelo más inteligente de OpenAI, que ofrece hasta 750 tokens de salida por segundo y permite a las empresas crear productos con mayor capacidad de respuesta, tomar decisiones con más rapidez e incorporar una IA potente directamente en sus flujos de trabajo más exigentes.
GPT‑5.6 Sol en modo Ultrarrápido está disponible hoy en una vista previa limitada para un grupo selecto de clientes. Ampliaremos el acceso a medida que aumente la capacidad. Regístrate para recibir novedades.


