Ampliem la frontera de preu-rendiment amb GPT‑5.6
En millorar l'eficiència de cada capa, OpenAI ofereix més rendiment per dòlar en un ventall més ampli de càrregues de treball empresarials.
Ahir vam explicar com GPT‑5.6 havia contribuït a fer que la seva execució fos més eficient. Avui traslladem aquests guanys als clients amb preus més baixos per a GPT‑5.6 Luna(s'obre en una finestra nova) i Terra(s'obre en una finestra nova), i un rendiment més ràpid amb GPT‑5.6 Sol a l'API. En conjunt, aquestes actualitzacions ajuden els clients a obtenir més rendiment de cada dòlar que inverteixen en IA i a avançar més de pressa quan el temps és clau.
A partir d'avui, GPT‑5.6 Luna, el nostre model més ràpid i assequible, costarà un 80 % menys, mentre que GPT‑5.6 Terra, el nostre model equilibrat per a la feina quotidiana, costarà un 20 % menys. Aquests preus més baixos de Luna i Terra també es reflecteixen en el còmput de l'ús respecte dels límits de les subscripcions de pagament quan s'utilitzen Codex i ChatGPT Work. Luna ofereix a les empreses una manera molt més rendible de gestionar grans volums de feina amb nivells de qualitat molt elevats. Pot utilitzar eines i completar fluxos de treball de diversos passos, cosa que permet executar a escala un ventall més ampli d'aplicacions d'IA.
Fer que la intel·ligència avançada sigui més abundant i assequible és essencial per a la missió d'OpenAI de garantir que l'AGI beneficiï tota la humanitat. Aquests canvis porten aquest compromís a la pràctica. Són el resultat d'anys de millores en la manera de crear, servir i posar a treballar els nostres models.
També introduïm el mode ràpid a l'API, que substitueix la nostra oferta de processament prioritari. Per a GPT‑5.6 Sol, el mode ràpid ofereix ara velocitats fins a 2,5 vegades superiors al processament Standard pel doble de preu, sense cap canvi en la intel·ligència. El mode ràpid és retrocompatible: les sol·licituds etiquetades com a prioritàries l'utilitzaran automàticament.
L'ús eficient de la IA comença pel resultat. La importància, el cost dels errors, la urgència i l'escala determinen l'equilibri adequat entre intel·ligència, velocitat, fiabilitat i cost. Aquest equilibri pot canviar d'un pas del flux de treball al següent.
GPT‑5.6 ofereix a les empreses molt més marge per optimitzar aquesta equació. Luna ofereix un rendiment comparable al de models que fa un any eren d'avantguarda, amb un cost per tasca d'uns 6 cèntims per cada dòlar i una velocitat gairebé nou vegades superior. En tasques professionals, segons Agents’ Last Exam, Luna supera Fable 5 amb un cost estimat per tasca gairebé un 99 % inferior.
A la pràctica, les empreses poden definir el resultat i l'estàndard de qualitat que necessiten i, després, fer servir avaluacions per determinar on més intel·ligència millora substancialment el resultat i on un processament més ràpid i econòmic pot oferir la mateixa qualitat. Per exemple, un flux de treball de programació podria utilitzar Sol per resoldre incerteses i definir el pla, i després Luna per implementar canvis ben especificats, escriure i executar proves i avaluar-ne els resultats. Un altre flux de treball pot requerir un equilibri diferent.
La família GPT‑5.6 amplia el ventall d'aquestes opcions. Les empreses poden aplicar la màxima intel·ligència útil en cada etapa i pagar el preu adequat pel valor que genera.
Oferir aquesta flexibilitat comença per fer més eficient cada capa que hi ha darrere dels models.
El nostre avantatge en eficiència prové de millorar els models, els sistemes d'inferència que els executen i l'entorn d'execució dels agents que els connecta amb eines i context. Els models GPT‑5.6 segueixen un camí més directe per completar la feina. Un encaminament millor manté el maquinari productiu, el programari de producció optimitzat genera segments textuals amb més eficiència i una gestió més intel·ligent del context ajuda els agents a no repetir feina ja completada. En conjunt, aquestes millores ens permeten completar més feina útil amb la mateixa capacitat de còmput i reduir el temps, els segments textuals i el cost necessaris per a cada resultat.
GPT‑5.6 Sol ens ajuda cada vegada més a descobrir i aplicar la pròxima ronda de millores. Dins d'un procés dirigit per persones, Sol va reescriure i optimitzar de manera autònoma nuclis de producció, va dissenyar i executar centenars d'experiments per millorar la generació de segments textuals i va supervisar l'entrenament, intervenint quan sorgien problemes. La feina amb els nuclis va ajudar a reduir un 20 % el cost integral de servir el model, mentre que els experiments van augmentar més d'un 15 % l'eficiència de generació de segments textuals. Aquesta feina continua i crea un cicle de retroalimentació més estret: a mesura que els nostres models milloren i poden treballar amb més autonomia, s'accelera la nostra capacitat per augmentar l'eficiència. Més informació sobre l'enginyeria que hi ha darrere de GPT‑5.6.
Satisfer la demanda d'intel·ligència abundant requereix més capacitat de còmput i que aquesta sigui més productiva. Estem creant una cartera d'infraestructures resilient i assignant cada càrrega de treball als sistemes més adequats per executar-la. Aquest plantejament cobreix tots dos extrems de la corba de preu-rendiment. A l'extrem de menor cost, els nous preus de Luna i Terra fan econòmicament viable executar grans volums de feina a una escala molt més gran. A l'extrem d'avantguarda, el mode ràpid permet als clients de l'API accedir més ràpidament a Sol quan el temps de resposta és important.
Les empreses poden incorporar més IA a les operacions quotidianes sense renunciar a la velocitat en les tasques més importants. L'anàlisi documental a gran escala, la classificació d'interaccions amb clients i la implementació rutinària es poden desplegar àmpliament de manera rendible, mentre que les càrregues de treball complexes de Sol poden avançar més ràpid quan el sobrecost està justificat.
Els guanys es poden acumular. Dins d'un procés dirigit per persones, els models més capaços ajuden el nostre equip tècnic a trobar la pròxima generació de millores i escurcen el camí cap a un rendiment millor i uns costos més baixos. La nostra estratègia continua centrada a millorar tant les capacitats com l'eficiència perquè cada generació d'intel·ligència pugui fer més feina a un cost inferior.
GPT‑5.6 Terra i Luna continuen disponibles a ChatGPT Work, Codex i l'API d'OpenAI. A ChatGPT Work i Codex, els usuaris de Free i ChatGPT Go poden accedir a Terra, mentre que els de ChatGPT Plus, ChatGPT Pro, Business i Enterprise poden triar Terra i Luna.
A partir del 30 de juliol, el preu de l'API serà de 2 $ per milió de segments textuals d'entrada i 12 $ per milió de segments textuals de sortida per a Terra, i de 0,20 $ per milió de segments textuals d'entrada i 1,20 $ per milió de segments textuals de sortida per a Luna. El preu de Sol no canvia. Els preus de les subscripcions i els pressupostos de quota de ChatGPT i Codex no canvien, mentre que l'ús de Terra i Luna ara consumeix menys crèdits. Els canvis de preus es començaran a desplegar a AWS avui més tard.
El mode ràpid per a GPT‑5.6 Sol substitueix al processament prioritari a l'API i s'alinea amb /fast a Codex. Les sol·licituds existents de l'API etiquetades com a prioritàries continuaran funcionant. Consulta tots els detalls dels preus de l'API.


