Lepszy stosunek ceny do wydajności dzięki GPT‑5.6
Zwiększając efektywność każdej warstwy, OpenAI zapewnia lepszą wydajność w stosunku do ceny w coraz większej liczbie zastosowań biznesowych.
Wczoraj pokazaliśmy, jak GPT‑5.6 pomógł zwiększyć własną efektywność działania. Dziś przekazujemy te korzyści klientom: obniżamy ceny modeli GPT‑5.6 Luna(otwiera nowe okno) i Terra(otwiera nowe okno) oraz zwiększamy szybkość modelu GPT‑5.6 Sol w API. Dzięki tym zmianom klienci mogą lepiej wykorzystać każdą złotówkę zainwestowaną w AI i działać szybciej, gdy liczy się czas.
Od dziś GPT‑5.6 Luna, nasz najszybszy i najtańszy model, będzie kosztować o 80% mniej, a GPT‑5.6 Terra, nasz wszechstronny model do codziennej pracy — o 20% mniej. Niższe ceny modeli Luna i Terra wpływają także na sposób rozliczania użycia w ramach płatnych subskrypcji podczas korzystania z Codex i ChatGPT Work. Luna zapewnia firmom znacznie bardziej opłacalny sposób realizacji dużej liczby zadań przy zachowaniu bardzo wysokiej jakości. Potrafi korzystać z narzędzi i realizować wieloetapowe przepływy pracy, dzięki czemu więcej zastosowań AI można praktycznie wdrażać na dużą skalę.
Zwiększanie dostępności zaawansowanej inteligencji i obniżanie jej kosztów ma kluczowe znaczenie dla misji OpenAI, którą jest zapewnienie korzyści z AGI całej ludzkości. Te zmiany przekładają tę deklarację na praktykę. Są wynikiem wieloletnich ulepszeń w sposobie tworzenia, udostępniania i wykorzystywania naszych modeli.
Wprowadzamy również Tryb szybki w API, który zastępuje usługę Przetwarzania priorytetowego. W przypadku GPT‑5.6 Sol Tryb szybki zapewnia teraz nawet 2,5 raza większą szybkość niż standardowe przetwarzanie, za dwukrotnie wyższą cenę i bez zmiany poziomu inteligencji. Tryb szybki jest zgodny wstecznie: żądania oznaczone jako priority będą automatycznie korzystać z Trybu szybkiego.
Efektywne wykorzystanie AI zaczyna się od określenia oczekiwanego wyniku. Znaczenie zadania, koszt błędu, pilność i skala wyznaczają właściwą równowagę między inteligencją, szybkością, niezawodnością i kosztami. Ta równowaga może się zmieniać na kolejnych etapach przepływu pracy.
GPT‑5.6 daje firmom znacznie większe możliwości optymalizacji tych zależności. Luna oferuje wydajność porównywalną z modelami, które rok temu należały do pionierskiej klasy, przy koszcie zadania wynoszącym około 6 centów na każdego dolara i niemal dziewięciokrotnie większej szybkości. W zadaniach profesjonalnych mierzonych testem Agents’ Last Exam Luna przewyższa Fable 5, a jej szacowany koszt zadania jest niemal o 99% niższy.
W praktyce firmy mogą określić oczekiwany wynik i standard jakości, a następnie za pomocą ewaluacji ustalić, gdzie dodatkowa inteligencja istotnie poprawia rezultat, a gdzie szybsze i tańsze przetwarzanie zapewnia tę samą jakość. Przykładowo przepływ programistyczny może wykorzystywać Sol do rozstrzygania niejasności i opracowania planu, a następnie Luna do wdrażania precyzyjnie określonych zmian, pisania i uruchamiania testów oraz oceny wyników. Inny przepływ pracy może wymagać odmiennej równowagi.
Rodzina GPT‑5.6 poszerza zakres dostępnych możliwości. Firmy mogą na każdym etapie korzystać z maksymalnego użytecznego poziomu inteligencji, płacąc cenę adekwatną do tworzonej wartości.
Zapewnienie tej elastyczności zaczyna się od zwiększenia efektywności każdej warstwy infrastruktury modeli.
Nasza przewaga w zakresie efektywności wynika z ulepszania modeli, obsługujących je systemów wnioskowania oraz agentowego otoczenia operacyjnego, które łączy je z narzędziami i kontekstem. Modele GPT‑5.6 realizują zadania w bardziej bezpośredni sposób. Lepsze trasowanie zapewnia efektywne wykorzystanie sprzętu, zoptymalizowane oprogramowanie produkcyjne wydajniej generuje tokeny, a inteligentniejsze zarządzanie kontekstem pomaga agentom unikać powtarzania ukończonej pracy. Łącznie te ulepszenia pozwalają wykonywać więcej użytecznej pracy przy tych samych zasobach obliczeniowych, skracając czas oraz zmniejszając liczbę tokenów i koszt każdego wyniku.
GPT‑5.6 Sol odgrywa coraz większą rolę w znajdowaniu i wdrażaniu kolejnych usprawnień. W ramach procesu prowadzonego przez ludzi Sol samodzielnie przepisał i zoptymalizował jądra produkcyjne, zaprojektował i przeprowadził setki eksperymentów usprawniających generowanie tokenów oraz monitorował trenowanie, interweniując w razie problemów. Prace nad jądrami pomogły obniżyć całkowity koszt udostępniania modelu o 20%, a eksperymenty zwiększyły efektywność generowania tokenów o ponad 15%. Prace trwają, tworząc coraz ściślejszą pętlę informacji zwrotnej: wraz z ulepszaniem modeli i wzrostem ich samodzielności przyspieszają również nasze działania na rzecz większej efektywności. Dowiedz się więcej o rozwiązaniach technicznych stojących za GPT‑5.6.
Zaspokojenie popytu na powszechnie dostępną inteligencję wymaga zarówno większej mocy obliczeniowej, jak i jej efektywniejszego wykorzystania. Budujemy odporny portfel infrastruktury i dopasowujemy każde obciążenie do systemów najlepiej przygotowanych do jego obsługi. Takie podejście wspiera oba krańce krzywej ceny do wydajności. Po stronie niższych kosztów nowe ceny modeli Luna i Terra sprawiają, że obsługa dużej liczby zadań staje się opłacalna na znacznie większą skalę. Po pionierskiej stronie skali Tryb szybki zapewnia klientom API szybszy dostęp do Sol, gdy istotny jest czas odpowiedzi.
Przedsiębiorstwa mogą szerzej wykorzystywać AI w codziennej działalności, nie rezygnując z szybkości przy realizacji najważniejszych zadań. Analiza dokumentów na dużą skalę, klasyfikacja interakcji z klientami i rutynowe wdrożenia mogą stać się opłacalne w szerokim zastosowaniu, a złożone zadania Sol mogą być realizowane szybciej, gdy uzasadnia to dodatkowy koszt.
Korzyści mogą się kumulować. W ramach procesu prowadzonego przez ludzi bardziej zaawansowane modele pomagają naszemu zespołowi technicznemu opracowywać kolejne usprawnienia, skracając drogę do wyższej wydajności i niższych kosztów. Nasza strategia nadal koncentruje się na zwiększaniu zarówno możliwości, jak i efektywności, aby każda kolejna generacja inteligencji mogła wykonywać więcej pracy niższym kosztem.
GPT‑5.6 Terra i Luna pozostają dostępne w ChatGPT Work, Codex oraz API OpenAI. W ChatGPT Work i Codex użytkownicy planów Free oraz ChatGPT Go mają dostęp do Terra, natomiast użytkownicy planów ChatGPT Plus, ChatGPT Pro, Business i Enterprise mogą wybierać między Terra a Luna.
Od 30 lipca ceny w API wynoszą 2 USD za milion tokenów wejściowych i 12 USD za milion tokenów wyjściowych w przypadku Terra oraz 0,20 USD za milion tokenów wejściowych i 1,20 USD za milion tokenów wyjściowych w przypadku Luna. Ceny Sol pozostają bez zmian. Ceny subskrypcji i limity użycia ChatGPT oraz Codex pozostają bez zmian, natomiast korzystanie z Terra i Luna zużywa teraz mniej środków. Zmiany cen zaczną być wdrażane w AWS jeszcze dziś.
Tryb szybki dla GPT‑5.6 Sol zastępuje Przetwarzanie priorytetowe w API i odpowiada opcji /fast w Codex. Istniejące żądania API oznaczone jako priority będą nadal działać. Zobacz pełne informacje o cenach API.


