W miarę udostępniania Codex i ChatGPT w trybie Work milionom osób na całym świecie zdobyliśmy praktyczną wiedzę o tym, co jest potrzebne, aby długo działające agenty dobrze sprawdzały się w rzeczywistych zastosowaniach. Wymagają one zaawansowanego otoczenia operacyjnego, które zarządza kontekstem, efektywnie korzysta z narzędzi i koordynuje pracę subagentów. Potrzebują też infrastruktury zapewniającej niezawodne działanie przez wiele dni oraz środowisk, w których mogą pracować z plikami, uruchamiać kod i zapisywać wyniki pośrednie.
Dziś udostępniamy w publicznej wersji beta Agents API(otwiera nowe okno), które za pośrednictwem prostego i elastycznego API zapewnia deweloperom to samo otoczenie operacyjne i infrastrukturę, na których działa Codex.
Agents API pozwala jednym wywołaniem API utworzyć agenta gotowego do użycia w środowisku produkcyjnym — wystarczy określić zadanie, model, narzędzia i środowisko:
OpenAI hostuje i utrzymuje otoczenie operacyjne. To Ty wybierasz środowisko obliczeniowe agenta: piaskownicę zarządzaną przez OpenAI, własną infrastrukturę albo rozwiązanie jednego z naszych partnerów oferujących piaskownice. Agents API zapewnia solidną podstawę do tworzenia agentów na bazie naszego zoptymalizowanego otoczenia operacyjnego i infrastruktury, dzięki czemu możesz skupić się na narzędziach, wiedzy i przepływach pracy wyróżniających Twojego agenta.

Agents API zapewnia Twoim agentom to samo otoczenie operacyjne i infrastrukturę, na których działa Codex.
Różne obciążenia wymagają różnych opcji przetwarzania, przechowywania danych i wdrażania. Agents API pozwala wybrać piaskownicę odpowiednią dla Twojej aplikacji.
Współpracujemy z dostawcami z ekosystemu(otwiera nowe okno), takimi jak Blaxel, Cloudflare, Daytona, DigitalOcean, E2B, Modal, Oracle, Runloop i Vercel, aby oferować najwyższej klasy integracje odpowiadające różnym potrzebom:
W pełni zarządzane środowiska lub wdrożenia w Twojej chmurze VPC
Określone mechanizmy przechowywania plików i danych poufnych
Różne konfiguracje procesorów CPU i GPU oraz pamięci, z profilami wydajności, zimnego startu i kosztów dopasowanymi do przepływu pracy w Twojej firmie.

Agents API oferuje najwyższej klasy integracje z popularnymi dostawcami z ekosystemu.
Deweloperom, którzy chcą szybko zacząć i wydajnie skalować rozwiązania, udostępniamy również piaskownicę hostowaną przez OpenAI(otwiera nowe okno). Wykorzystuje ona tę samą infrastrukturę piaskownic, na której działają Codex i ChatGPT.
OpenAI udostępnia piaskownicę i nią zarządza, zapewniając agentowi bezpieczne, wydajne środowisko do uruchamiania kodu, pracy z plikami i tworzenia artefaktów. Piaskownice można elastycznie konfigurować przy użyciu własnych plików, pakietów, umiejętności i wtyczek, aby zapewnić agentowi wszystko, czego potrzebuje do wykonania zadania.
Korzystanie z nowych możliwości modelu często wymaga przebudowy otoczenia operacyjnego, co zabiera cenny czas, który można byłoby poświęcić na ulepszanie aplikacji. Agents API zapewnia wersjonowany dostęp do tych możliwości przy każdej premierze modelu. Utrzymujemy i stale ulepszamy otoczenie operacyjne wraz z naszymi modelami, dzięki czemu po każdej aktualizacji Twoje agenty mogą działać wydajniej. Najnowsze ulepszenia otoczenia operacyjnego obejmują między innymi:
Aby modele mogły pracować przez wiele godzin, stworzyliśmy mechanizm zarządzania kontekstem, który pomaga agentom zachowywać istotne informacje podczas dłuższych sesji. Gdy sesja zbliża się do limitu kontekstu, Agents API automatycznie kompaktuje(otwiera nowe okno) wcześniejszy kontekst, zachowując informacje potrzebne agentowi do dalszej pracy. Deweloperzy mogą tworzyć przepływy pracy obejmujące wiele okien kontekstu bez wdrażania własnej logiki kompaktowania.
Agents API pomaga agentom znajdować odpowiednie narzędzia i efektywnie z nich korzystać. Wyszukiwanie narzędzi(otwiera nowe okno) wczytuje odpowiednie definicje narzędzi w razie potrzeby, co pomaga ograniczyć zużycie tokenów i koszty, a jednocześnie zachować pamięć podręczną modelu. Gdy narzędzia są już dostępne, programowe wywoływanie narzędzi(otwiera nowe okno) pozwala agentom wykonywać wywołania równolegle, łączyć powiązane operacje oraz filtrować lub zestawiać wyniki w kodzie. Dzięki temu mogą przetwarzać duże ilości danych i przekazywać do kontekstu tylko istotne wyniki. Agents API obsługuje MCP, funkcje niestandardowe i wbudowane narzędzia, takie jak wyszukiwanie w internecie.
Dzięki obsłudze wielu agentów(otwiera nowe okno) Agents API może dzielić złożone zadania na niezależne części i przekazywać je działającym równolegle subagentom. Każdy subagent zachowuje własny kontekst, co pomaga mu skupić się na przydzielonym zadaniu, natomiast główny agent koordynuje pracę wszystkich i scala wyniki. Może to przyspieszyć badania, analizy i zadania programistyczne, które korzystają na pracy równoległej, bez konieczności tworzenia własnej orkiestracji.
Agents API działa na bazie otoczenia operacyjnego Codex z otwartym kodem źródłowym, zapewniając deweloperom wgląd w podstawową logikę koordynującą wywołania modelu, narzędzia i kontekst. W ramach Agents API OpenAI obsługuje i utrzymuje to otoczenie operacyjne, a deweloperzy mogą przeglądać jego publicznie dostępny kod źródłowy(otwiera nowe okno) i uczyć się na jego podstawie.
Agents API jest od dzisiaj dostępne w publicznej wersji beta dla wszystkich programistów. Korzystanie z Agents API nie wiąże się z dodatkowymi opłatami – płacisz tylko za tokeny i narzędzia używane przez Twoje agenty, zgodnie z informacjami na naszej stronie z cennikiem(otwiera nowe okno).
Więcej informacji znajdziesz w przeglądzie Agents API(otwiera nowe okno). Skorzystaj z przewodnika szybkiego startu(otwiera nowe okno), aby rozpocząć pracę i wykorzystać otoczenie operacyjne Codex we własnych agentach.
W trakcie publicznych testów beta będziemy szybko wprowadzać udoskonalenia w oparciu o Twoje opinie, pracując nad ogólnodostępną wersją. Daj nam znać, co działa, gdzie napotykasz trudności i czego potrzebujesz, aby tworzyć i uruchamiać swoje agenty w środowisku produkcyjnym.


