Предпросмотр режима Ultrafast: GPT‑5.6 Sol до 14 раз быстрее
Новый класс скорости для передового интеллекта, превращающий скорость в конкурентное преимущество.
Сегодня мы представляем предварительную версию Ultrafast — нового тарифного плана, в котором GPT‑5.6 Sol работает до 14 раз быстрее, чем при стандартной обработке. Сначала он станет доступен в API OpenAI. Ultrafast работает на базе Cerebras и генерирует до 750 выходных токенов в секунду, позволяя использовать нашу самую интеллектуальную модель в продуктах и рабочих процессах, где важна каждая секунда.
С моделью GPT‑5.6 мы расширяем границы возможностей наших моделей и повышаем их эффективность на каждом уровне нашей инфраструктуры. Благодаря этим улучшениям продвинутый интеллект стал доступнее по цене и полезнее для большего числа людей. До сих пор для работы в реальном времени обычно приходилось выбирать менее крупную или более специализированную модель. Ultrafast открывает новое направление развития: больше полезной работы за секунду.
Когда ради скорости больше не нужно жертвовать интеллектом, ИИ можно внедрять в самые чувствительные ко времени бизнес-процессы, открывая возможности для новых видов работы. Мы уже увидели несколько перспективных сценариев применения Ultrafast:
- Реагирование на инциденты и обеспечение надёжности: при сбое критически важной системы анализировать журналы приложений, последние изменения в коде и отчёты инженеров, чтобы определить вероятную причину и помочь подготовить исправление ещё до устранения сбоя.
- Финансовые исследования и безопасность: анализировать рыночные сигналы, оценивать транзакции и выявлять подозрительную активность, пока ситуация продолжает меняться.
- Поддержка клиентов и голосовые сервисы: решать сложные проблемы клиентов в реальном времени, не прерывая разговор, даже если для поиска ответа требуется выполнить несколько действий или обратиться к нескольким системам.
- Торговля: отвечать на вопросы о товарах, проверять наличие, персонализировать рекомендации и устранять проблемы при оформлении заказа, пока покупатель ещё принимает решение и сомнения не привели к брошенной корзине.
- Исследования и эксперименты в реальном времени: превратить исследования, которые раньше выполнялись всю ночь, в интерактивную рабочую сессию, позволяя командам проверять идеи, изучать результаты, корректировать подход и проводить новые эксперименты, не теряя темпа.
В период предварительного доступа мы работаем с первой группой клиентов, чтобы понять, где такая скорость даёт наибольший эффект и как полученные выводы могут со временем помочь развитию наших продуктов. Если вашему бизнесу нужен передовой интеллект на максимальной скорости, вы можете подписаться на уведомления о расширении доступа.
Модель GPT‑5.6 Sol в режиме Ultrafast и в стандартном режиме обработки параллельно создаёт работающий 3D-симулятор склада по одному и тому же текстовому промпту.
Мы тестируем GPT‑5.6 Sol в режиме Ultrafast с первой группой компаний в программировании, торговле, финансовых исследованиях, поддержке и других интерактивных областях. Начав с бизнес-процессов, мы можем изучать эти условия в реальной производственной среде. Первые проекты клиентов помогают нам понять, где десятикратный прирост скорости создаёт наибольшую ценность и как меняются продукты, когда модель успевает за использующим её человеком. По мере увеличения мощностей мы будем учитывать эти выводы при развёртывании сервиса.
В OpenAI группа разработчиков тестирует GPT‑5.6 Sol в режиме Ultrafast, чтобы понять, каким рабочим процессам особенно полезен передовой интеллект, способный отвечать в реальном времени.
Один из примеров использования Ultrafast нашей командой — реагирование на инциденты. При срабатывании оповещения инженерам необходимо составить точную картину происходящего, пока состояние системы и данные продолжают меняться. Команды используют Ultrafast, чтобы быстро читать журналы, анализировать трассировки, обобщать обсуждения, определять следующие проверки, а также помогать готовить или проверять исправления — всё это за малую долю прежнего времени и с интеллектом Sol. Это сокращает задержку между обнаружением сигнала, проверкой гипотезы и выбором следующего действия, при этом ответственность за оценку ситуации и развёртывание по-прежнему несут инженеры.
В исследованиях наша команда использует Ultrafast для быстрого поиска по источникам знаний, выполнения запросов к данным, а также сбора, систематизации и обобщения информации из подключённых инструментов. Обычно в ходе исследований участники нашей команды запускают пакет экспериментов на ночь, а утром изучают результаты. С Ultrafast этот цикл становится короче, позволяя выполнять несколько итераций в течение рабочего дня.
Ultrafast знаменует новый этап нашего партнёрства с Cerebras, цель которого — обеспечить логический вывод со сверхнизкой задержкой на платформе OpenAI. Теперь Cerebras обеспечивает работу самой интеллектуальной модели OpenAI — GPT‑5.6 Sol в режиме Ultrafast — со скоростью до 750 выходных токенов в секунду. Благодаря этому компании могут создавать более отзывчивые продукты, быстрее принимать решения и внедрять мощный ИИ непосредственно в самые требовательные рабочие процессы.
Сегодня GPT‑5.6 Sol в режиме Ultrafast доступна ограниченной группе клиентов в рамках предварительного доступа. Мы будем расширять доступ по мере увеличения мощностей. Подписаться на новости.


