AI · 12 września 2026

Dostępne również w Italiano, Português (Brasil), Svenska, Norsk

OpenAI uruchamia publiczną betę Agent API dla programistów

brown concrete building under white clouds during daytime
Alexandre Viard / Unsplash

OpenAI udostępniła w trybie publicznej bety interfejs programistyczny Agent API, który pozwala na uruchamianie agentów chmurowych przy użyciu infrastruktury zarządzanej przez firmę. Rozwiązanie to umożliwia programistom budowanie i uruchamianie agentów opartych na kodzie, przenosząc na OpenAI odpowiedzialność za orkiestrację, długotrwałe sesje oraz zarządzanie kontekstem. Dzięki temu twórcy mogą skupić się na unikalnych aspektach swoich aplikacji, zamiast implementować złożoną logikę operacyjną od podstaw.

Interfejs ten opiera się na otwartym kodzie źródłowym szkieletu Codex, który jest zarządzany i utrzymywany przez OpenAI. Firma zapewnia wersjonowane funkcje przy każdym wydaniu nowego modelu, co zmniejsza konieczność wprowadzania znaczących zmian w infrastrukturze agentów przez programistów. Taki model obsługi pozwala na stabilne działanie systemów w zmieniającym się środowisku technologicznym, bez konieczności ciągłego dostosowywania kodu do nowych specyfikacji modeli językowych.

System automatyzuje zarządzanie kontekstem, co jest kluczowe dla zadań wymagających długiego czasu wykonania. Gdy sesja zbliża się do limitu kontekstu, poprzednie treści są automatycznie kompresowane, aby zachować istotne informacje. Programiści nie muszą więc samodzielnie implementować logiki kompresji, co umożliwia kontynuowanie pracy przez wiele okien kontekstowych. Funkcja ta zapewnia spójność danych w trakcie wieloetapowych procesów obliczeniowych.

Efektywność użycia narzędzi została zwiększona dzięki wyszukiwaniu narzędzi, które pobiera definicje tylko wtedy, gdy są potrzebne. Programistyczne wywoływanie narzędzi pozwala na równoległe wykonywanie wielu zadań oraz filtrowanie i łączenie wyników w kodzie. System obsługuje również protokół MCP, funkcje niestandardowe oraz wyszukiwanie w sieci, co rozszerza możliwości interakcji agenta z zewnętrznymi zasobami i usługami.

Złożone zadania można dzielić na wiele podagentów za pomocą funkcji multi-agent. Każdy podagent pracuje w niezależnym kontekście, a główny agent zbiera wyniki, co wspiera równoległe przetwarzanie w badaniach, analizie i kodowaniu. Programiści mogą wybrać środowisko obliczeniowe, korzystając z piaskownic zarządzanych przez OpenAI lub własnej infrastruktury. Dostępne są również piaskownice partnerów, takich jak BlackCell, Cloudflare, Daytona, DigitalOcean, E2B, Modal, Oracle, RunLoop i Vercel.

W piaskownicach hostowanych przez OpenAI można konfigurować pliki, pakiety, umiejętności i wtyczki, aby agent mógł wykonywać kod, przetwarzać pliki i generować wyniki. Obecnie przetwarzanie danych odbywa się wyłącznie w Stanach Zjednoczonych, a funkcja natychmiastowego usuwania danych po ich przetworzeniu nie jest wspierana. Publiczna beta jest dostępna dla wszystkich programistów bez dodatkowych opłat za interfejs, a koszty obejmują jedynie zużyte tokeny i narzędzia.