Ir al contenido principal
OpenAI

30 de julio de 2026

Producto

Mejorar la relación precio-rendimiento con GPT‑5.6

Al mejorar la eficiencia de cada capa, OpenAI ofrece más rendimiento por cada dólar en un mayor número de cargas de trabajo empresariales.

Cargando…

Ayer explicamos cómo GPT‑5.6 contribuyó a que su propia ejecución fuera más eficiente. Hoy trasladamos esas mejoras a nuestros clientes con precios más bajos para GPT‑5.6 Luna(se abre en una ventana nueva) y Terra(se abre en una ventana nueva), y un mayor rendimiento de GPT‑5.6 Sol en la API. En conjunto, estas novedades permiten a los clientes sacar más partido de cada dólar que invierten en IA y avanzar más rápido cuando el tiempo es decisivo.

Desde hoy, GPT‑5.6 Luna, nuestro modelo más rápido y asequible, costará un 80 % menos, mientras que GPT‑5.6 Terra, nuestro modelo equilibrado para el trabajo diario, costará un 20 % menos. Estos precios más bajos de Luna y Terra también se reflejan en cómo se contabiliza el uso en las suscripciones de pago al utilizar Codex y ChatGPT Work. Luna ofrece a las empresas una opción mucho más rentable para gestionar grandes volúmenes de trabajo con niveles de calidad muy altos. Puede utilizar herramientas y completar flujos de trabajo de varios pasos, lo que permite ejecutar a escala una gama más amplia de aplicaciones de IA.

Hacer que la inteligencia avanzada sea más abundante y asequible es fundamental para la misión de OpenAI de garantizar que la IAG beneficie a toda la humanidad. Estos cambios llevan ese compromiso a la práctica. Son fruto de años de mejoras en la forma de crear, ofrecer y poner a trabajar nuestros modelos.

También presentamos el modo rápido en la API, que sustituye a nuestra oferta de procesamiento prioritario. En GPT‑5.6 Sol, el modo rápido ofrece ahora velocidades hasta 2,5 veces superiores a las del procesamiento Standard por el doble de precio, sin cambios en la inteligencia. El modo rápido es retrocompatible: las solicitudes etiquetadas como prioritarias lo utilizarán automáticamente.

1 de 6
GPT‑5.6 Luna es lo más cerca que hemos estado de una inteligencia tan barata que no merece la pena medir su consumo. Nunca había visto un modelo tan asequible y a la vez tan potente: está abriendo para Replit casos de uso que no esperábamos poder desarrollar hasta dentro de mucho tiempo.
Michele Catasta, presidente y responsable de IA de Replit

Ajustar la inteligencia al resultado

El uso eficiente de la IA comienza por el resultado. La importancia, el coste de los errores, la urgencia y la escala determinan el equilibrio adecuado entre inteligencia, velocidad, fiabilidad y coste. Ese equilibrio puede cambiar de un paso del flujo de trabajo al siguiente.

GPT‑5.6 ofrece a las empresas mucho más margen para optimizar esa ecuación. Luna ofrece un rendimiento comparable al de modelos que hace un año eran de vanguardia por unos 6 centavos por cada dólar y tarea, y a una velocidad casi nueve veces mayor. En tareas profesionales, según Agents’ Last Exam, Luna supera a Fable 5 con un coste estimado por tarea casi un 99 % inferior.

En la práctica, las empresas pueden definir el resultado y el nivel de calidad que necesitan y, después, utilizar evaluaciones para determinar dónde una mayor inteligencia mejora sustancialmente el resultado y dónde un procesamiento más rápido y económico puede ofrecer la misma calidad. Por ejemplo, un flujo de trabajo de programación podría utilizar Sol para resolver dudas y definir el plan, y después Luna para implementar cambios bien especificados, escribir y ejecutar pruebas y evaluar los resultados. Otro flujo de trabajo podría requerir un equilibrio diferente.

La familia GPT‑5.6 amplía el abanico de opciones. Las empresas pueden aplicar la máxima inteligencia útil en cada etapa y pagar un precio acorde con el valor que genera.

Para ofrecer esa flexibilidad, primero hay que mejorar la eficiencia de cada capa que sustenta los modelos.

Cómo ampliamos la frontera de la eficiencia

Nuestra ventaja en eficiencia procede de mejorar los modelos, los sistemas de inferencia que los ejecutan y el arnés de agentes que los conecta con las herramientas y el contexto. Los modelos GPT‑5.6 siguen una ruta más directa para completar el trabajo. Un enrutamiento mejor mantiene productivo el hardware, el software de producción optimizado genera tokens de forma más eficiente y una gestión más inteligente del contexto evita que los agentes repitan trabajo ya realizado. En conjunto, estas mejoras nos permiten realizar más trabajo útil con la misma capacidad de cómputo, reduciendo el tiempo, los tokens y el coste necesarios para cada resultado.

GPT‑5.6 Sol nos ayuda cada vez más a encontrar y materializar la siguiente ronda de mejoras. Dentro de un proceso dirigido por personas, Sol reescribió y optimizó de forma autónoma kernels de producción, diseñó y ejecutó cientos de experimentos para mejorar la generación de tokens y supervisó el entrenamiento, interviniendo cuando surgían problemas. El trabajo con los kernels ayudó a reducir en un 20 % el coste integral de servir el modelo, mientras que sus experimentos aumentaron en más de un 15 % la eficiencia de generación de tokens. Este trabajo continúa y crea un ciclo de retroalimentación más estrecho: a medida que nuestros modelos mejoran y pueden trabajar con mayor autonomía, se acelera nuestra capacidad para aumentar la eficiencia. Más información sobre la ingeniería que sustenta GPT‑5.6.

Una estrategia de cómputo diseñada para escalar

Para satisfacer la demanda de inteligencia abundante se necesita tanto más capacidad de cómputo como un uso más productivo de ella. Estamos creando una cartera de infraestructuras resiliente y asignando cada carga de trabajo a los sistemas más adecuados para ejecutarla. Este enfoque abarca ambos extremos de la curva de precio-rendimiento. En el extremo de menor coste, los nuevos precios de Luna y Terra hacen que los grandes volúmenes de trabajo sean rentables a una escala mucho mayor. En el extremo de vanguardia, el modo rápido ofrece a los clientes de la API un acceso más veloz a Sol cuando el tiempo de respuesta es importante.

Las empresas pueden incorporar más IA a sus operaciones diarias sin sacrificar velocidad en sus tareas más importantes. El análisis de documentos a gran escala, la clasificación de interacciones con clientes y las implementaciones rutinarias pueden generalizarse de forma rentable, mientras que las cargas de trabajo complejas de Sol pueden avanzar más rápido cuando el sobrecoste esté justificado.

Las mejoras pueden acumularse. Dentro de un proceso dirigido por personas, los modelos más capaces ayudan a nuestro equipo técnico a encontrar la siguiente generación de mejoras y acortan el camino hacia un mayor rendimiento y unos costes más bajos. Nuestra estrategia sigue centrada en mejorar tanto la capacidad como la eficiencia para que cada generación de inteligencia pueda realizar más trabajo a menor coste.

Disponibilidad y precios

GPT‑5.6 Terra y Luna siguen disponibles en ChatGPT Work, Codex y la API de OpenAI. En ChatGPT Work y Codex, los usuarios de los planes Free y ChatGPT Go pueden acceder a Terra, mientras que los de ChatGPT Plus, ChatGPT Pro, Business y Enterprise pueden elegir entre Terra y Luna.

A partir del 30 de julio, el precio de la API será de 2 $ por millón de tokens de entrada y 12 $ por millón de tokens de salida para Terra, y de 0,20 $ por millón de tokens de entrada y 1,20 $ por millón de tokens de salida para Luna. El precio de Sol no cambia. Los precios de las suscripciones y los límites de cuota de ChatGPT y Codex no cambian, mientras que el uso de Terra y Luna consume ahora menos créditos. Los cambios de precios comenzarán a implementarse en AWS a lo largo del día de hoy.

El modo rápido para GPT‑5.6 Sol sustituye al procesamiento prioritario en la API y se corresponde con /fast en Codex. Las solicitudes actuales de la API etiquetadas como prioritarias seguirán funcionando. Consulta todos los detalles sobre los precios de la API.

Autor

OpenAI