A medida que ampliamos Codex y ChatGPT para Work a millones de personas en todo el mundo, aprendimos qué se necesita para que los agentes de ejecución prolongada funcionen bien en la práctica. Los agentes útiles necesitan un potente arnés de ejecución que gestione el contexto, use las herramientas de manera eficiente y coordine subagentes. También necesitan infraestructura que los mantenga en funcionamiento de forma confiable durante días, con entornos donde puedan trabajar con archivos, ejecutar código y guardar resultados intermedios.
Hoy presentamos en versión beta pública la API de Agents(se abre en una nueva ventana), que ofrece a los desarrolladores el mismo arnés de ejecución y la misma infraestructura que impulsan Codex mediante una API sencilla y flexible.
Con la API de Agents, puedes crear un agente listo para producción con una sola llamada a la API especificando la tarea, el modelo, las herramientas y el entorno:
OpenAI aloja y mantiene el arnés de ejecución. Tú eliges el entorno de cómputo del agente: un entorno aislado administrado por OpenAI, tu propia infraestructura o uno de nuestros socios de entornos aislados. La API de Agents te brinda una base sólida para crear agentes sobre nuestra infraestructura y nuestro arnés de ejecución optimizado para agentes, de modo que puedas concentrarte en las herramientas, el conocimiento y los flujos de trabajo que hacen único a tu agente.

La API de Agents impulsa tus agentes con el mismo arnés de ejecución y la misma infraestructura que sustentan Codex.
Cada carga de trabajo necesita distintas opciones de cómputo, almacenamiento e implementación. La API de Agents te permite elegir un entorno aislado que se adapte a tu aplicación.
Estamos colaborando con proveedores del ecosistema(se abre en una nueva ventana), como Blaxel, Cloudflare, Daytona, DigitalOcean, E2B, Modal, Oracle, Runloop y Vercel, para ofrecer integraciones de primer nivel que cubran diversas necesidades:
Entornos totalmente administrados o implementaciones dentro de tu VPC
Mecanismos específicos para almacenar archivos y secretos
Distintas configuraciones de CPU, GPU y memoria, con perfiles de rendimiento, arranque en frío y costo que se adaptan al flujo de trabajo de tu empresa.

La API de Agents ofrece integraciones de primer nivel con proveedores populares del ecosistema.
Para los desarrolladores que quieren comenzar rápidamente y escalar de forma eficiente, también presentamos el entorno aislado alojado por OpenAI(se abre en una nueva ventana). Este aprovecha la misma infraestructura de aislamiento que impulsa Codex y ChatGPT.
OpenAI aprovisiona y administra el entorno aislado, lo que brinda a tu agente un entorno seguro y de alto rendimiento para ejecutar código, trabajar con archivos y producir artefactos. Estos entornos aislados pueden configurarse de forma flexible con tus archivos, paquetes, habilidades y complementos para brindar al agente lo que necesita a fin de completar la tarea.
Aprovechar las nuevas capacidades de los modelos suele implicar rehacer tu arnés de ejecución, lo que te quita tiempo valioso para mejorar tu aplicación. La API de Agents ofrece acceso con control de versiones a estas capacidades con cada lanzamiento de un modelo. Mantenemos y mejoramos continuamente el arnés de ejecución junto con nuestros modelos para ayudar a tus agentes a obtener un mejor rendimiento con cada actualización. Por ejemplo, entre las mejoras recientes del arnés de ejecución se incluyen:
Para admitir modelos que trabajan durante horas, creamos un sistema de gestión del contexto que ayuda a los agentes a conservar la información relevante durante sesiones más largas. La API de Agents compacta automáticamente(se abre en una nueva ventana) el contexto anterior cuando una sesión se acerca a su límite de contexto y conserva la información que el agente necesita para continuar. Los desarrolladores pueden crear flujos de trabajo que abarquen varias ventanas de contexto sin implementar su propia lógica de compactación.
La API de Agents ayuda a los agentes a encontrar las herramientas adecuadas y usarlas de manera eficiente. La búsqueda de herramientas(se abre en una nueva ventana) carga las definiciones de las herramientas relevantes cuando se necesitan, lo que ayuda a reducir el uso de tokens y los costos, a la vez que preserva la caché del modelo. Una vez que las herramientas están disponibles, las llamadas programáticas a herramientas(se abre en una nueva ventana) permiten que los agentes ejecuten llamadas en paralelo, encadenen operaciones relacionadas y filtren o combinen resultados mediante código para procesar grandes volúmenes de datos e incorporar al contexto solo los resultados relevantes. La API de Agents admite MCP, funciones personalizadas y herramientas integradas, como la búsqueda web.
Gracias a la compatibilidad con varios agentes(se abre en una nueva ventana), la API de Agents puede dividir tareas complejas en partes independientes y delegarlas a subagentes que trabajan en paralelo. Cada subagente mantiene su propio contexto para poder concentrarse en su tarea, mientras que el agente principal coordina el trabajo y reúne los resultados. Esto puede acelerar las tareas de investigación, análisis y programación que se benefician del trabajo en paralelo, sin que tengas que crear tu propio sistema de orquestación.
La API de Agents funciona con el arnés de ejecución de código abierto de Codex, lo que permite a los desarrolladores examinar la lógica central que coordina las llamadas al modelo, las herramientas y el contexto. Con la API de Agents, OpenAI opera y mantiene ese arnés de ejecución, mientras que los desarrolladores pueden inspeccionar su código fuente público(se abre en una nueva ventana) y aprender de él.
La API de agentes está disponible desde hoy en beta pública para todos los desarrolladores. No hay cargos adicionales por usar la API de agentes: solo pagas por los tokens y las herramientas que utilizan tus agentes, como se indica en nuestra página de precios(se abre en una nueva ventana).
Explora la descripción general de la API de agentes(se abre en una nueva ventana) para obtener más información o sigue la guía rápida(se abre en una nueva ventana) para comenzar e incorporar en tus propios agentes el arnés de ejecución que utiliza Codex.
Durante la beta pública, haremos ajustes rápidos en función de tus comentarios mientras avanzamos hacia la disponibilidad general. Cuéntanos qué está funcionando, dónde encuentras dificultades y qué necesitas para crear y operar tus agentes en producción.


