随着我们将 Codex 和“ChatGPT 工作”推广至全球数百万用户,我们逐渐掌握了让长期运行的智能体在实际应用中高效运作的关键。实用的智能体需要一个强大的执行框架,用于管理上下文、高效使用工具并协调子智能体。它们还需要可靠支持其连续运行数天的基础设施,以及能让它们处理文件、运行代码并保存中间结果的环境。
今天,我们推出公开测试版 Agents API(在新窗口中打开),通过简单灵活的 API,将支持 Codex 的同款执行框架和基础设施带给开发者。
借助 Agents API,只需指定任务、模型、工具和环境并进行一次 API 调用,即可创建可用于生产环境的智能体:
执行框架由 OpenAI 托管和维护。智能体的计算环境由你选择:OpenAI 管理的沙箱、自有基础设施,或我们沙箱合作伙伴提供的环境。Agents API 立足于我们优化后的智能体执行框架和基础设施,为构建智能体提供坚实根基,让你可以专注于工具、知识和工作流,打造独具特色的智能体。

Agents API 采用支持 Codex 的同款执行框架和基础设施,为你的智能体赋能。
不同工作负载需要不同的计算、存储和部署选项。Agents API 让你可以选择适合自身应用的沙箱。
我们正与 Blaxel、Cloudflare、Daytona、DigitalOcean、E2B、Modal、Oracle、Runloop 和 Vercel 等生态系统提供商合作(在新窗口中打开),针对多种需求提供一流的集成方案:
全托管环境或在你的 VPC 内部署
特定的文件和机密信息存储机制
提供多种 CPU、GPU 和内存配置,在性能、冷启动表现和成本方面满足公司的工作流需求。

Agents API 与热门生态系统提供商实现一流集成。
对于希望快速上手并高效扩展的开发者,我们还推出了 OpenAI 托管的沙箱(在新窗口中打开)。它采用了为 Codex 和 ChatGPT 提供支持的同款沙箱基础设施。
OpenAI 负责配置和管理沙箱,为你的智能体提供安全、高性能的环境,以运行代码、处理文件并生成成果。你可以灵活地为这些沙箱配置文件、软件包、技能和插件,为智能体提供完成任务所需的一切。
要发挥模型的新能力,往往需要重新设计执行框架,挤占原本可用于改进应用的宝贵时间。每次发布新模型时,Agents API 都会以版本化方式提供这些能力。我们会在持续改进模型的同时,维护并不断优化执行框架,帮助你的智能体通过每次升级获得更出色的性能。例如,近期对执行框架的改进包括:
为了支持模型连续工作数小时,我们构建了上下文管理机制,帮助智能体在更长的会话中保留相关信息。当会话接近上下文上限时,Agents API 会自动压缩(在新窗口中打开)较早的上下文,同时保留智能体继续工作所需的信息。开发者无需自行实现压缩逻辑,即可构建跨越多个上下文窗口的工作流。
Agents API 可帮助智能体找到合适的工具并高效使用。工具搜索(在新窗口中打开)会按需加载相关工具定义,在保留模型缓存的同时减少 Token 用量和成本。工具就绪后,程序化工具调用(在新窗口中打开)可让智能体并行执行调用、串联相关操作,并通过代码筛选或合并结果,从而处理海量数据,同时只将相关结果送回上下文。Agents API 支持 MCP、自定义函数以及网页搜索等内置工具。
借助多智能体支持(在新窗口中打开),Agents API 可将复杂任务拆分为相互独立的部分,并委派给多个子智能体并行处理。每个子智能体都维护各自的上下文,以便专注于分配到的任务;主智能体则协调它们的工作并汇总结果。对于适合并行处理的研究、分析和编码任务,这可以提升速度,且无需你自行构建编排系统。
Agents API 由开源的 Codex 执行框架提供支持,让开发者可以了解协调模型调用、工具和上下文的核心逻辑。使用 Agents API 时,OpenAI 负责运行和维护该执行框架,开发者则可以查看其公开代码库(在新窗口中打开)并从中学习。
Agents API 公开测试版现已面向所有开发者开放。使用 Agents API 无需支付额外费用。你只需为智能体使用的 Token 和工具付费,详情请参阅我们的定价页面(在新窗口中打开)。
阅读 Agents API 概览(在新窗口中打开)了解更多信息,或参照快速入门指南(在新窗口中打开)开始使用,将 Codex 背后的执行框架引入你自己的智能体。
在公开测试期间,我们将根据你的反馈快速迭代,同时推进正式发布。请告诉我们哪些方面运行良好、你遇到了哪些阻碍,以及你在生产环境中构建和运行智能体需要什么。


