Перейти до основного вмісту
OpenAI

30 липня 2026 р.

Продукт

Розширюємо межі ціни й продуктивності з GPT‑5.6

Підвищуючи ефективність кожного рівня, OpenAI забезпечує більше продуктивності за кожен долар у ширшому спектрі корпоративних завдань.

Завантаження…

Учора ми розповіли, як GPT‑5.6 допомогла підвищити ефективність власної роботи. Сьогодні ми передаємо ці переваги клієнтам: знижуємо ціни на GPT‑5.6 Luna(відкривається у новому вікні) і Terra(відкривається у новому вікні) та прискорюємо GPT‑5.6 Sol в API. Разом ці оновлення допомагають клієнтам отримувати більше від кожного долара, вкладеного в ШІ, і працювати швидше, коли час має значення.

Відсьогодні GPT‑5.6 Luna, наша найшвидша й найдоступніша модель, коштуватиме на 80% менше, а GPT‑5.6 Terra — збалансована модель для повсякденної роботи — на 20% менше. Зниження цін на Luna й Terra також враховано в тому, як їх використання зараховується до лімітів платних підписок у Codex і ChatGPT Work. Luna пропонує компаніям значно вигідніший спосіб виконувати великі обсяги роботи з дуже високою якістю. Вона може використовувати інструменти й виконувати багатоетапні робочі процеси, завдяки чому ширший спектр застосунків ШІ стає доцільно масштабувати.

Зробити передовий інтелект доступнішим і поширенішим — ключова складова місії OpenAI: забезпечити, щоб AGI приносив користь усьому людству. Ці зміни втілюють це зобов’язання на практиці. Вони стали результатом багаторічного вдосконалення способів створення, розгортання та практичного застосування наших моделей.

Ми також запроваджуємо в API Швидкий режим, який замінює нашу пропозицію пріоритетної обробки. Для GPT‑5.6 Sol Швидкий режим тепер забезпечує до 2,5 раза вищу швидкість, ніж стандартна обробка, за подвійну ціну й без зміни рівня інтелекту. Швидкий режим має зворотну сумісність: запити з позначкою priority автоматично використовуватимуть Швидкий режим.

1 із 6
GPT‑5.6 Luna — найближче, що ми бачили до інтелекту, настільки дешевого, що його майже не потрібно обліковувати. Я ще не бачив, щоб настільки доступна модель була такою потужною — вона відкриває для Replit сценарії, які ми ще довго не планували реалізовувати.
Мікеле Катаста, президент і керівник напряму ШІ в Replit

Добираємо рівень інтелекту відповідно до результату

Ефективне використання ШІ починається з визначення бажаного результату. Важливість завдання, ціна помилки, терміновість і масштаб визначають належний баланс інтелекту, швидкості, надійності й вартості. Цей баланс може змінюватися на кожному наступному етапі робочого процесу.

GPT‑5.6 дає компаніям значно більше можливостей оптимізувати це співвідношення. Luna забезпечує продуктивність, порівнянну з моделями, які рік тому належали до передового класу, приблизно за 6 центів з кожного долара на завдання та з майже дев’ятикратною швидкістю. У професійних завданнях за оцінкою Agents’ Last Exam Luna перевершує Fable 5, а орієнтовна вартість завдання для неї майже на 99% нижча.

На практиці компанії можуть визначити потрібний результат і стандарт якості, а потім за допомогою оцінювань з’ясувати, де додатковий інтелект суттєво поліпшує результат, а де таку саму якість забезпечить швидша й дешевша обробка. Наприклад, у процесі розробки коду можна використовувати Sol, щоб усунути невизначеність і скласти план, а потім Luna — щоб реалізувати чітко визначені зміни, написати й запустити тести та оцінити результати. Інший робочий процес може потребувати іншого балансу.

Сімейство GPT‑5.6 розширює діапазон такого вибору. Компанії можуть застосовувати максимально корисний рівень інтелекту на кожному етапі й платити ціну, що відповідає створеній цінності.

Така гнучкість починається з підвищення ефективності кожного рівня, що забезпечує роботу моделей.

Як ми розширюємо межі ефективності

Наша перевага в ефективності ґрунтується на вдосконаленні моделей, систем інференсу, що забезпечують їхню роботу, і агентної системи harness, яка з’єднує їх з інструментами та контекстом. Моделі GPT‑5.6 виконують роботу прямішим шляхом. Краще маршрутизування забезпечує продуктивне використання обладнання, оптимізоване виробниче ПЗ ефективніше генерує токени, а розумніше керування контекстом допомагає агентам не повторювати вже виконану роботу. Разом ці вдосконалення дають змогу виконувати більше корисної роботи з тими самими обчислювальними ресурсами, скорочуючи час, кількість токенів і вартість кожного результату.

GPT‑5.6 Sol дедалі активніше допомагає нам знаходити й упроваджувати нові вдосконалення. У межах керованого людьми процесу Sol автономно переписала й оптимізувала виробничі ядра, спроєктувала та провела сотні експериментів для вдосконалення генерації токенів, а також стежила за навчанням і втручалася в разі проблем. Робота над ядрами допомогла на 20% знизити сукупну вартість обслуговування моделі, а експерименти підвищили ефективність генерації токенів більш ніж на 15%. Ця робота триває, створюючи тісніший цикл зворотного зв’язку: що кращими стають наші моделі й що автономніше вони працюють, то швидше ми можемо підвищувати ефективність. Докладніше про інженерні рішення в основі GPT‑5.6.

Обчислювальна стратегія, розрахована на масштабування

Щоб задовольнити попит на доступний у великих обсягах інтелект, потрібно не лише більше обчислювальних ресурсів, а й продуктивніше їх використання. Ми створюємо стійкий портфель інфраструктури й добираємо для кожного навантаження системи, що найкраще підходять для його виконання. Цей підхід охоплює обидва краї кривої ціни та продуктивності. На доступнішому її краю нові ціни на Luna й Terra роблять великі обсяги роботи економічно доцільними в набагато ширшому масштабі. На передовому краю Швидкий режим надає клієнтам API швидший доступ до Sol, коли важливий час відповіді.

Підприємства можуть ширше впроваджувати ШІ в повсякденні операції, не жертвуючи швидкістю у своїх найважливіших завданнях. Масштабний аналіз документів, класифікацію взаємодій із клієнтами та стандартну реалізацію можна широко застосовувати з економічною вигодою, а складні навантаження Sol — прискорювати, коли доплата виправдана.

Переваги можуть накопичуватися. У межах керованого людьми процесу потужніші моделі допомагають нашій технічній команді знаходити наступне покоління вдосконалень, скорочуючи шлях до вищої продуктивності й нижчих витрат. Наша стратегія й надалі зосереджена на розвитку можливостей та ефективності, щоб кожне нове покоління інтелекту могло виконувати більше роботи за нижчою ціною.

Доступність і ціни

GPT‑5.6 Terra й Luna і надалі доступні в ChatGPT Work, Codex та API OpenAI. У ChatGPT Work і Codex користувачам планів Free та Go доступна Terra, а користувачі Plus, Pro, Business і Enterprise можуть вибирати між Terra й Luna.

З 30 липня ціна API для Terra становитиме $2 за мільйон вхідних токенів і $12 за мільйон вихідних, а для Luna — $0,20 за мільйон вхідних токенів і $1,20 за мільйон вихідних. Ціна Sol не змінюється. Ціни підписок і квоти ChatGPT та Codex не змінюються, але використання Terra й Luna тепер витрачає менше кредитів. Оновлені ціни почнуть упроваджувати в AWS пізніше сьогодні.

Швидкий режим для GPT‑5.6 Sol замінює пріоритетну обробку в API та узгоджується з /fast у Codex. Наявні запити API з позначкою priority і надалі працюватимуть. Переглянути повну інформацію про ціни API.

Автор

OpenAI