По-добро съотношение цена–производителност с GPT‑5.6
Чрез повишаване на ефективността на всеки слой OpenAI осигурява повече производителност за всеки долар при повече корпоративни натоварвания.
Вчера споделихме как GPT‑5.6 помогна за по-ефективната си работа. Днес предаваме тези ползи на клиентите чрез по-ниски цени за GPT‑5.6 Luna(отваря се в нов прозорец) и Terra(отваря се в нов прозорец) и по-висока производителност на GPT‑5.6 Sol в API. Заедно тези актуализации помагат на клиентите да получат повече от всеки долар, инвестиран в ИИ, и да работят по-бързо, когато времето е от значение.
От днес GPT‑5.6 Luna, нашият най-бърз и достъпен модел, ще струва с 80% по-малко, а GPT‑5.6 Terra — балансираният ни модел за ежедневна работа — с 20% по-малко. По-ниските цени на Luna и Terra се отразяват и върху начина, по който потреблението се отчита към платените абонаменти при използване на Codex и ChatGPT Work. Luna предлага на бизнеса много по-рентабилен начин да обработва големи обеми работа при изключително високо качество. Тя може да използва инструменти и да изпълнява многостъпкови работни процеси, което прави практично мащабното внедряване на по-широк кръг приложения с ИИ.
Осигуряването на по-широко достъпно и по-евтино високо ниво на интелект е в основата на мисията на OpenAI да гарантира, че AGI носи ползи за цялото човечество. Тези промени превръщат този ангажимент в действие. Те са резултат от години усъвършенстване на начина, по който изграждаме, обслужваме и използваме моделите си.
Въвеждаме и Бърз режим в API, който заменя услугата ни Priority Processing. За GPT‑5.6 Sol Бърз режим вече осигурява до 2,5 пъти по-висока скорост от стандартната обработка срещу двойна цена, без промяна в нивото на интелект. Бърз режим е обратно съвместим: заявките с етикет priority автоматично ще използват Бърз режим.
Ефективното използване на ИИ започва с желания резултат. Значимостта, цената на грешката, спешността и мащабът определят правилния баланс между ниво на интелект, скорост, надеждност и цена. Този баланс може да се променя на всяка следваща стъпка от работния процес.
GPT‑5.6 дава на бизнеса много повече възможности да оптимизира това съотношение. Luna предлага производителност, сравнима с авангардните модели отпреди година, при цена за задача от около 6 цента на долар и почти девет пъти по-висока скорост. При професионални задачи, измерени чрез Agents’ Last Exam, Luna превъзхожда Fable 5 при приблизително 99% по-ниска цена на задача.
На практика бизнесите могат да определят желания резултат и стандарт за качество, а след това чрез оценки да установят къде допълнителното ниво на интелект съществено подобрява резултата и къде по-бързата и евтина обработка осигурява същото качество. Например работен процес за програмиране може да използва Sol за изясняване на неяснотите и съставяне на план, а след това Luna — за внедряване на ясно дефинираните промени, писане и изпълнение на тестове и оценяване на резултатите. Друг работен процес може да изисква различен баланс.
Семейството GPT‑5.6 разширява набора от възможности за избор. Бизнесите могат да прилагат максимално полезното ниво на интелект на всеки етап, като плащат подходящата цена за създаваната стойност.
Тази гъвкавост започва с повишаване на ефективността на всеки слой зад моделите.
Предимството ни в ефективността идва от подобряването на моделите, системите за извод, които ги изпълняват, и агентната рамка, която ги свързва с инструменти и контекст. Моделите GPT‑5.6 изпълняват работата по по-пряк път. По-доброто маршрутизиране поддържа хардуера продуктивен, оптимизираният производствен софтуер генерира токени по-ефективно, а по-интелигентното управление на контекста помага на Агентите да не повтарят вече свършена работа. Заедно тези подобрения ни позволяват да вършим повече полезна работа със същите изчислителни ресурси, като намаляват времето, токените и разходите за всеки резултат.
GPT‑5.6 Sol все повече ни помага да откриваме и реализираме следващата поредица от подобрения. В рамките на процес, ръководен от хора, Sol автономно пренаписа и оптимизира производствени ядра, проектира и проведе стотици експерименти за подобряване на генерирането на токени и наблюдава обучението, като се намесваше при възникване на проблеми. Работата по ядрата помогна да намалим с 20% цялостните разходи за обслужване на модела, а експериментите увеличиха ефективността при генериране на токени с над 15%. Тази работа продължава и създава по-тесен цикъл на обратна връзка: с подобряването на моделите и способността им да работят по-автономно се ускорява и повишаването на ефективността. Научете повече за инженерните решения зад GPT‑5.6.
Удовлетворяването на търсенето на широко достъпно ниво на интелект изисква както повече изчислителни ресурси, така и по-продуктивното им използване. Изграждаме устойчив портфейл от инфраструктура и насочваме всяко натоварване към най-подходящите за него системи. Този подход обхваща и двата края на кривата цена–производителност. В ниския ценови сегмент новите цени на Luna и Terra правят обработката на големи обеми работа икономична в много по-голям мащаб. В авангардния сегмент Бърз режим осигурява на клиентите на API по-бърз достъп до Sol, когато времето за отговор е важно.
Предприятията могат да внедрят повече ИИ в ежедневните операции, без да жертват скоростта при най-значимата си работа. Мащабният анализ на документи, класифицирането на взаимодействия с клиенти и рутинното внедряване могат да станат рентабилни за широко приложение, а сложните натоварвания със Sol — да се изпълняват по-бързо, когато допълнителната цена е оправдана.
Ползите могат да се натрупват. В рамките на процес, ръководен от хора, по-способните модели помагат на техническия ни екип да открие следващото поколение подобрения, като съкращават пътя към по-висока производителност и по-ниски разходи. Стратегията ни остава насочена към едновременно развитие на възможностите и ефективността, така че всяко следващо поколение ниво на интелект да върши повече работа на по-ниска цена.
GPT‑5.6 Terra и Luna остават налични в ChatGPT Work, Codex и API на OpenAI. В ChatGPT Work и Codex потребителите на Free и ChatGPT Go имат достъп до Terra, а тези с ChatGPT Plus, ChatGPT Pro, Business и Enterprise могат да избират между Terra и Luna.
От 30 юли цената на API е 2 щ.д. за милион входни токени и 12 щ.д. за милион изходни токени за Terra и 0,20 щ.д. за милион входни токени и 1,20 щ.д. за милион изходни токени за Luna. Цената на Sol остава непроменена. Цените на абонаментите и квотите в ChatGPT и Codex остават непроменени, а използването на Terra и Luna вече изразходва по-малко кредити. Промените в цените ще започнат да се въвеждат в AWS по-късно днес.
Бърз режим за GPT‑5.6 Sol заменя Priority Processing в API и съответства на /fast в Codex. Съществуващите заявки към API с етикет priority ще продължат да работят. Вижте пълната информация за цените на API.


