Переход к основному контенту
OpenAI

30 июля 2026 г.

Товар

GPT‑5.6: ещё выше производительность при тех же затратах

Оптимизируя каждый уровень системы, OpenAI повышает производительность на каждый вложенный доллар для всё более широкого круга корпоративных задач.

Загрузка…

Вчера мы рассказали, как GPT‑5.6 помогла сделать собственную работу эффективнее. Сегодня эти достижения приносят пользу клиентам: цены на GPT‑5.6 Luna(открывается в новом окне) и Terra(открывается в новом окне) снижены, а GPT‑5.6 Sol в API стала быстрее. В совокупности эти обновления помогают клиентам получать больше отдачи от каждого доллара, вложенного в ИИ, и действовать быстрее, когда время особенно важно.

С сегодняшнего дня GPT‑5.6 Luna, наша самая быстрая и доступная модель, будет стоить на 80% дешевле, а GPT‑5.6 Terra, сбалансированная модель для повседневной работы, — на 20% дешевле. Снижение цен на Luna и Terra также отразилось на учете использования в рамках платных подписок при работе с Codex и режимом «Работа» в ChatGPT. Luna предлагает компаниям гораздо более экономичный способ выполнять большие объемы работы с очень высоким качеством. Она умеет использовать инструменты и выполнять многоэтапные процессы, благодаря чему более широкий спектр ИИ-приложений становится целесообразно масштабировать.

Сделать передовые интеллектуальные возможности доступными и экономически выгодными — важнейшая часть миссии OpenAI, направленной на то, чтобы AGI приносил пользу всему человечеству. Эти изменения воплощают данное обязательство на практике. Они стали результатом многолетнего совершенствования разработки, развертывания и практического применения наших моделей.

Мы также представляем Быстрый режим в API, который заменяет предложение Priority Processing. Для GPT‑5.6 Sol Быстрый режим обеспечивает скорость до 2,5 раза выше по сравнению со стандартной обработкой при стоимости в два раза выше — без каких-либо изменений в уровне интеллектуальных возможностей модели. Быстрый режим полностью совместим с существующими интеграциями: запросы с параметром priority будут автоматически обрабатываться в Быстром режиме.

1 из 6
GPT‑5.6 Luna — самое близкое к практически бесплатному интеллекту решение из всех, что нам доводилось видеть. Я никогда не видел настолько доступной и при этом настолько мощной модели — она открывает для Replit сценарии применения, которые мы не ожидали реализовать еще долгое время.
Микеле Катаста, президент и руководитель направления ИИ в Replit

Интеллектуальные возможности под конкретный результат

Эффективное использование ИИ начинается с определения желаемого результата. Значимость задачи, цена ошибки, срочность и масштаб определяют оптимальное соотношение интеллектуальных возможностей, скорости, надежности и стоимости. Это соотношение может меняться от одного этапа рабочего процесса к другому.

GPT‑5.6 дает компаниям гораздо больше возможностей для оптимизации этого соотношения. Luna обеспечивает уровень производительности, сопоставимый с моделями, которые ещё год назад считались передовыми, при этом выполнение одной задачи обходится примерно в 6% их стоимости и происходит почти в девять раз быстрее. В профессиональных задачах, согласно бенчмарку Agents’ Last Exam, Luna превосходит Fable 5, а расчётная стоимость выполнения одной задачи почти на 99% ниже.

На практике компании могут задать нужный результат и стандарт качества, а затем с помощью оценок определить, где дополнительные интеллектуальные возможности заметно улучшают результат, а где более быстрая и дешевая обработка обеспечивает то же качество. Например, в процессе разработки Sol может устранять неопределенность и составлять план, а Luna — вносить четко определенные изменения, писать и запускать тесты и оценивать результаты. Для другого рабочего процесса может потребоваться иное соотношение.

Семейство GPT‑5.6 расширяет диапазон доступных вариантов. Компании могут применять максимум полезных интеллектуальных возможностей на каждом этапе, оплачивая их соразмерно создаваемой ценности.

Такая гибкость начинается с повышения эффективности каждого уровня, лежащего в основе моделей.

Как мы расширяем границы эффективности

Наше преимущество в эффективности обусловлено совершенствованием моделей, обеспечивающих их работу систем инференса и агентной обвязки, которая связывает их с инструментами и контекстом. Модели GPT‑5.6 идут к результату более прямым путем. Улучшенная маршрутизация повышает загрузку оборудования, оптимизированное производственное ПО эффективнее генерирует токены, а более продвинутое управление контекстом помогает агентам не повторять уже выполненную работу. В совокупности эти улучшения позволяют выполнять больше полезной работы при тех же вычислительных ресурсах, сокращая время, число токенов и стоимость каждого результата.

GPT‑5.6 Sol всё активнее помогает нам находить новые способы повысить эффективность и воплощать их в жизнь. В рамках процесса под руководством человека Sol автономно переписала и оптимизировала производственные ядра, спланировала и провела сотни экспериментов для улучшения генерации токенов, а также контролировала обучение и вмешивалась при возникновении проблем. Работа над ядрами помогла снизить совокупную стоимость обслуживания модели на 20%, а эксперименты повысили эффективность генерации токенов более чем на 15%. Эта работа продолжается, формируя более тесную обратную связь: по мере совершенствования моделей и роста их автономности ускоряется и повышение нашей эффективности. Подробнее о технологиях, лежащих в основе GPT‑5.6.

Масштабируемая стратегия вычислительных ресурсов

Чтобы удовлетворить спрос на широкодоступные возможности ИИ, нужно не только больше вычислительных мощностей, но и более эффективное их использование. Мы создаем устойчивую инфраструктуру и для каждой рабочей нагрузки подбираем наиболее подходящие системы. Такой подход охватывает оба конца кривой цены и производительности. В нижнем ценовом сегменте новые цены на Luna и Terra позволяют экономично выполнять большие объемы работы в гораздо более широком масштабе. На уровне передовых моделей Быстрый режим дает клиентам API ускоренный доступ к Sol, когда важно время отклика.

Компании могут шире внедрять ИИ в повседневные рабочие процессы, не жертвуя скоростью при выполнении самых значимых задач. Масштабный анализ документов, классификация взаимодействий с клиентами и типовые задачи реализации становятся экономически оправданными для широкого применения, а сложные задачи Sol могут выполняться быстрее, когда более высокая стоимость оправдана.

Эти преимущества усиливают друг друга. В рамках процесса под руководством человека более совершенные модели помогают нашей технической команде находить новые возможности для улучшений, сокращая путь к повышению производительности и снижению затрат. Наша стратегия по-прежнему направлена на одновременное повышение возможностей и эффективности, чтобы каждое новое поколение моделей ИИ выполняло больше задач с меньшими затратами.

Доступность и цены

GPT‑5.6 Terra и Luna по-прежнему доступны в ChatGPT Work, Codex и Responses API. В ChatGPT Work и Codex пользователи тарифов Free и Go могут использовать Terra, а пользователям Plus, Pro, Business и Enterprise доступны как Terra, так и Luna.

С 30 июля стоимость Terra в API составит 2 доллара за миллион входных токенов и 12 долларов за миллион выходных, а Luna — 0,20 и 1,20 доллара соответственно. Цены на Sol остаются прежними. Цены на подписки и квоты ChatGPT и Codex остаются прежними, но использование Terra и Luna теперь расходует меньше кредитов. Новые цены начнут внедряться в AWS позднее сегодня.

Быстрый режим для GPT‑5.6 Sol заменяет Priority Processing в API и соответствует команде /fast в Codex. Существующие запросы API с меткой priority продолжат работать. Полная информация о ценах на API.

Автор

OpenAI