Прескокни до главната содржина
OpenAI

30 јули 2026 г.

Производ

Унапредување на односот цена–перформанси со GPT‑5.6

Со зголемување на ефикасноста на секој слој, OpenAI нуди подобри перформанси за секој вложен долар кај повеќе деловни оптоварувања.

Се вчитува...

Вчера споделивме како GPT‑5.6 помогна сопственото извршување да стане поефикасно. Денес им ги пренесуваме овие придобивки на клиентите преку пониски цени за GPT‑5.6 Luna(се отвора во нов прозорец) и Terra(се отвора во нов прозорец), како и побрзи перформанси со GPT‑5.6 Sol во API. Заедно, овие ажурирања им овозможуваат на клиентите да добијат повеќе од секој долар вложен во ВИ и да напредуваат побрзо кога времето е важно.

Од денес, GPT‑5.6 Luna, нашиот најбрз и најдостапен модел, ќе чини 80% помалку, додека GPT‑5.6 Terra, нашиот урамнотежен модел за секојдневна работа, ќе чини 20% помалку. Пониските цени за Luna и Terra се одразуваат и врз начинот на кој користењето се пресметува во платените претплати при употреба на Codex и ChatGPT Работа. Luna им нуди на компаниите многу поисплатлив начин за обработка на голем обем работа со исклучително висок квалитет. Може да користи алатки и да завршува работни текови во повеќе чекори, со што поширок спектар на ВИ-апликации станува практичен за примена во голем обем.

Обезбедувањето понапредна, подостапна и поевтина интелигенција е клучен дел од мисијата на OpenAI да се погрижи AGI да му користи на целото човештво. Овие промени ја претвораат таа заложба во практика. Тие се резултат на долгогодишни подобрувања во начинот на кој ги создаваме, опслужуваме и применуваме нашите модели.

Во API го воведуваме и Брзиот режим, кој ја заменува нашата понуда Priority Processing. За GPT‑5.6 Sol, Брзиот режим сега овозможува до 2,5 пати поголема брзина од стандардната обработка, по двојно повисока цена и без промена на интелигенцијата. Брзиот режим е компатибилен наназад: барањата означени со priority автоматски ќе го користат Брзиот режим.

1 од 6
GPT‑5.6 Luna е најблиску што сме стигнале до интелигенција толку евтина што трошокот речиси не вреди да се мери. Никогаш не сум видел толку достапен модел да биде толку моќен — тој овозможува начини на примена за Replit што не очекувавме да ги создадеме уште долго време.
Michele Catasta, претседател & раководител за ВИ, Replit

Усогласување на интелигенцијата со посакуваниот исход

Ефикасното користење на ВИ започнува од посакуваниот исход. Важноста, цената на грешката, итноста и обемот ја одредуваат вистинската рамнотежа меѓу интелигенцијата, брзината, сигурноста и трошоците. Таа рамнотежа може да се менува од еден до друг чекор во работниот тек.

GPT‑5.6 им дава на компаниите многу поголем простор за оптимизирање на таа равенка. Luna нуди перформанси споредливи со моделите што пред една година беа од гранична класа, по околу 6 центи за секој долар по задача и со речиси деветкратно поголема брзина. Кај професионалните задачи, мерено со Agents’ Last Exam, Luna го надминува Fable 5 со проценет трошок по задача што е речиси 99% понизок.

Во практика, компаниите можат да ги одредат потребниот исход и стандардот за квалитет, а потоа преку евалуации да утврдат каде дополнителната интелигенција значително го подобрува резултатот и каде побрзата и поевтина обработка може да го даде истиот квалитет. На пример, работен тек за програмирање може да го користи Sol за разрешување на неизвесностите и дефинирање на планот, а потоа Luna за спроведување јасно специфицирани промени, пишување и извршување тестови и оценување на резултатите. За друг работен тек може да биде потребна поинаква рамнотежа.

Семејството GPT‑5.6 го проширува опсегот на тие можности. Компаниите можат да ја применат максималната корисна интелигенција во секоја фаза, плаќајќи соодветна цена за вредноста што ја создава.

За да се овозможи таа флексибилност, најпрво мора да се зголеми ефикасноста на секој слој зад моделите.

Како ја поместуваме границата на ефикасноста

Нашата предност во ефикасноста произлегува од подобрувањето на моделите, системите за инференција што ги извршуваат и агентската рамка што ги поврзува со алатките и контекстот. Моделите GPT‑5.6 ги извршуваат задачите по подиректен пат. Подоброто насочување го одржува хардверот продуктивен, оптимизираниот продукциски софтвер поефикасно генерира токени, а попаметното управување со контекстот им помага на агентите да не ја повторуваат веќе завршената работа. Заедно, овие подобрувања ни овозможуваат да завршиме повеќе корисна работа со истите пресметковни ресурси, намалувајќи ги времето, токените и трошоците потребни за секој резултат.

GPT‑5.6 Sol сè повеќе ни помага да ги откриеме и оствариме следните подобрувања. Во процес предводен од луѓе, Sol самостојно преработи и оптимизираше продукциски кернели, осмисли и спроведе стотици експерименти за подобрување на генерирањето токени и ја следеше обуката, интервенирајќи кога ќе се појавеа проблеми. Работата на кернелите помогна вкупниот трошок за опслужување на моделот да се намали за 20%, додека експериментите ја зголемија ефикасноста на генерирањето токени за повеќе од 15%. Оваа работа продолжува и создава пократок циклус на повратни информации: како што нашите модели се подобруваат и можат да работат посамостојно, така се забрзува и нашата способност да ја зголемуваме ефикасноста. Прочитајте повеќе за инженерските решенија зад GPT‑5.6.

Стратегија за пресметковни ресурси создадена за голем обем

За да се задоволи побарувачката за изобилна интелигенција, потребни се и повеќе и попродуктивни пресметковни ресурси. Градиме отпорно портфолио на инфраструктура и секое работно оптоварување го поврзуваме со системите што се најсоодветни за негово извршување. Овој пристап ги поддржува двата краја на кривата цена–перформанси. На поевтиниот крај, новите цени за Luna и Terra овозможуваат економично извршување на многу поголем обем работа. На граничниот крај, Брзиот режим им овозможува на клиентите на API побрз пристап до Sol кога времето на одговор е важно.

Компаниите можат да воведат повеќе ВИ во секојдневното работење без да ја жртвуваат брзината кај своите најважни задачи. Обемната анализа на документи, класификацијата на интеракциите со клиенти и рутинската имплементација може да станат економични за широка примена, додека сложените оптоварувања со Sol може да се извршуваат побрзо кога повисоката цена е оправдана.

Придобивките може да се надоврзуваат една на друга. Во процес предводен од луѓе, поспособните модели му помагаат на нашиот технички тим да ја открие следната генерација подобрувања, скратувајќи го патот до подобри перформанси и пониски трошоци. Нашата стратегија останува насочена кон истовремено унапредување на способностите и ефикасноста, за секоја нова генерација интелигенција да може да заврши повеќе работа со понизок трошок.

Достапност и цени

GPT‑5.6 Terra и Luna остануваат достапни во ChatGPT Работа, Codex и API на OpenAI. Во ChatGPT Работа и Codex, корисниците на Free и ChatGPT Go можат да пристапат до Terra, додека корисниците на ChatGPT Plus, ChatGPT Pro, Business и Enterprise можат да изберат Terra или Luna.

Од 30 јули, цената на API за Terra изнесува 2 $ за милион влезни токени и 12 $ за милион излезни токени, а за Luna 0,20 $ за милион влезни токени и 1,20 $ за милион излезни токени. Цената на Sol останува непроменета. Цените на претплатите и квотите во ChatGPT и Codex остануваат непроменети, додека користењето на Terra и Luna сега троши помалку кредити. Промените на цените ќе почнат да се воведуваат во AWS подоцна денес.

Брзиот режим за GPT‑5.6 Sol го заменува Priority Processing во API и е усогласен со /fast во Codex. Постојните барања до API означени со priority ќе продолжат да функционираат. Погледнете ги сите детали за цените на API.

Автор

OpenAI