Pasar al contenido principal
OpenAI

30 de julio de 2026

Producto

Impulsar la relación precio-rendimiento con GPT‑5.6

Al hacer más eficiente cada capa, OpenAI ofrece un mayor rendimiento por dólar en más cargas de trabajo empresariales.

Cargando...

Ayer explicamos cómo GPT‑5.6 ayudó a que su propia ejecución fuera más eficiente. Hoy trasladamos esas mejoras a nuestros clientes con precios más bajos para GPT‑5.6 Luna(se abre en una nueva ventana) y Terra(se abre en una nueva ventana), y un mayor rendimiento de GPT‑5.6 Sol en la API. En conjunto, estas novedades permiten a los clientes aprovechar mejor cada dólar que invierten en IA y avanzar más rápido cuando el tiempo es crucial.

Desde hoy, GPT‑5.6 Luna, nuestro modelo más rápido y económico, costará un 80 % menos, mientras que GPT‑5.6 Terra, nuestro modelo equilibrado para el trabajo cotidiano, costará un 20 % menos. Los precios más bajos de Luna y Terra también se reflejan en cómo se contabiliza el uso respecto de las suscripciones de pago al usar Codex y ChatGPT Work. Luna ofrece a las empresas una forma mucho más rentable de gestionar grandes volúmenes de trabajo con niveles de calidad muy altos. Puede usar herramientas y completar flujos de trabajo de varios pasos, lo que permite ejecutar a escala una variedad más amplia de aplicaciones de IA.

Lograr que la inteligencia avanzada sea más abundante y asequible es fundamental para la misión de OpenAI de garantizar que la IAG beneficie a toda la humanidad. Estos cambios llevan ese compromiso a la práctica. Son el resultado de años de mejoras en la forma en que desarrollamos, implementamos y ponemos a trabajar nuestros modelos.

También presentamos el Modo rápido en la API, que sustituye nuestra oferta de procesamiento prioritario. Para GPT‑5.6 Sol, el Modo rápido ahora ofrece velocidades hasta 2,5 veces mayores que el procesamiento estándar por el doble de precio, sin cambios en la inteligencia. El Modo rápido es compatible con versiones anteriores: las solicitudes etiquetadas como priority usarán automáticamente el Modo rápido.

1 de 6
GPT‑5.6 Luna es lo más cerca que hemos estado de una inteligencia tan económica que ya no vale la pena medir su consumo. Nunca había visto un modelo tan asequible y a la vez tan potente: está habilitando casos de uso para Replit que no esperábamos desarrollar en mucho tiempo.
Michele Catasta, presidente y director de IA de Replit

Ajustar la inteligencia al resultado

Usar la IA de manera eficiente comienza por definir el resultado. La importancia de la tarea, el costo de los errores, la urgencia y la escala determinan el equilibrio adecuado entre inteligencia, velocidad, confiabilidad y costo. Ese equilibrio puede cambiar entre un paso y otro de un flujo de trabajo.

GPT‑5.6 ofrece a las empresas mucho más margen para optimizar esa ecuación. Luna ofrece un rendimiento comparable al de modelos que hace un año eran de vanguardia, con un costo por tarea de unos 6 centavos por dólar y una velocidad casi nueve veces mayor. En tareas profesionales, según Agents’ Last Exam, Luna supera a Fable 5 con un costo estimado por tarea casi un 99 % menor.

En la práctica, las empresas pueden definir el resultado y el estándar de calidad que necesitan y, luego, usar evaluaciones para determinar dónde una mayor inteligencia mejora sustancialmente el resultado y dónde un procesamiento más rápido y económico puede ofrecer la misma calidad. Por ejemplo, un flujo de trabajo de programación podría usar Sol para resolver incertidumbres y definir el plan, y luego usar Luna para implementar cambios bien especificados, escribir y ejecutar pruebas, y evaluar los resultados. Otro flujo de trabajo podría requerir un equilibrio diferente.

La familia GPT‑5.6 amplía el abanico de opciones. Las empresas pueden aplicar la máxima inteligencia útil en cada etapa y pagar el precio adecuado por el valor que genera.

Ofrecer esa flexibilidad comienza por hacer más eficiente cada capa que sustenta los modelos.

Cómo ampliamos la frontera de la eficiencia

Nuestra ventaja en eficiencia proviene de mejorar los modelos, los sistemas de inferencia que los ejecutan y el arnés de ejecución de agentes que los conecta con herramientas y contexto. Los modelos GPT‑5.6 siguen una ruta más directa para completar el trabajo. Un mejor enrutamiento mantiene productivo el hardware, el software de producción optimizado genera tokens con más eficiencia y una gestión más inteligente del contexto ayuda a los agentes a no repetir trabajo ya completado. En conjunto, estas mejoras nos permiten completar más trabajo útil con la misma capacidad de cómputo, lo que reduce el tiempo, los tokens y el costo necesarios para cada resultado.

GPT‑5.6 Sol nos ayuda cada vez más a descubrir y ofrecer la siguiente ronda de mejoras. Dentro de un proceso dirigido por personas, Sol reescribió y optimizó de forma autónoma kernels de producción, diseñó y ejecutó cientos de experimentos para mejorar la generación de tokens y supervisó el entrenamiento, interviniendo cuando surgían problemas. El trabajo con los kernels ayudó a reducir en un 20 % el costo integral de ejecutar el modelo, mientras que sus experimentos aumentaron en más de un 15 % la eficiencia de generación de tokens. Este trabajo continúa y crea un ciclo de retroalimentación más estrecho: a medida que nuestros modelos mejoran y pueden trabajar con mayor autonomía, se acelera nuestra capacidad de aumentar la eficiencia. Obtén más información sobre la ingeniería detrás de GPT‑5.6.

Una estrategia de cómputo diseñada para operar a escala

Satisfacer la demanda de inteligencia abundante requiere tanto más capacidad de cómputo como un uso más productivo de ella. Estamos desarrollando una cartera de infraestructura resiliente y asignando cada carga de trabajo a los sistemas más adecuados para ejecutarla. Este enfoque abarca ambos extremos de la curva de relación precio-rendimiento. En el extremo de menor costo, los nuevos precios de Luna y Terra hacen rentable el trabajo de gran volumen a una escala mucho mayor. En el extremo de vanguardia, el Modo rápido brinda a los clientes de la API acceso más veloz a Sol cuando el tiempo de respuesta es importante.

Las empresas pueden incorporar más IA a sus operaciones cotidianas sin sacrificar velocidad en sus tareas más importantes. El análisis de documentos a gran escala, la clasificación de interacciones con clientes y las implementaciones rutinarias pueden ejecutarse ampliamente de forma rentable, mientras que las cargas de trabajo complejas de Sol pueden avanzar más rápido cuando se justifica pagar más.

Los beneficios pueden acumularse. Dentro de un proceso dirigido por personas, los modelos más capaces ayudan a nuestro equipo técnico a descubrir la próxima generación de mejoras, lo que acorta el camino hacia un mayor rendimiento y menores costos. Nuestra estrategia sigue centrada en impulsar tanto la capacidad como la eficiencia para que cada generación de inteligencia pueda realizar más trabajo a un costo menor.

Disponibilidad y precios

GPT‑5.6 Terra y Luna siguen disponibles en ChatGPT Work, Codex y la API de OpenAI. En ChatGPT Work y Codex, los usuarios de Free y ChatGPT Go pueden acceder a Terra, mientras que los usuarios de ChatGPT Plus, ChatGPT Pro, Business y Enterprise pueden elegir Terra y Luna.

A partir del 30 de julio, los precios de la API serán de USD 2 por millón de tokens de entrada y USD 12 por millón de tokens de salida para Terra, y de USD 0,20 por millón de tokens de entrada y USD 1,20 por millón de tokens de salida para Luna. El precio de Sol no cambia. Los precios de suscripción y las cuotas de ChatGPT y Codex no cambian, mientras que el uso de Terra y Luna ahora consume menos créditos. Los cambios de precios comenzarán a implementarse en AWS más tarde hoy.

El Modo rápido para GPT‑5.6 Sol sustituye el procesamiento prioritario en la API y se alinea con /fast en Codex. Las solicitudes existentes de la API etiquetadas como priority seguirán funcionando. Consulta todos los detalles de precios de la API.

Autor

OpenAI