OpenAI推出AgentsAPI公测,复用Codex框架助力开发者构建云端智能体
OpenAI正式上线Agents API公测版,该API复用了Codex背后的智能体执行框架和基础设施,允许开发者通过一次API调用创建可执行多步骤任务的云端AI智能体。服务支持上下文自动压缩、工具并...
9月10日,OpenAI宣布推出Agents API公测版,标志着其在AI代理基础设施商业化方面迈出重要一步。该API将此前仅用于支撑Codex及企业版ChatGPT的核心代理架构以编程接口形式对外开放,开发者无需额外付费即可接入,仅按实际消耗的token及工具调用量计费。
核心端点为POST https://api.openai.com/v1/agents/sessions,开发者只需指定任务、模型、工具与运行环境,即可快速创建生产级代理。OpenAI负责维护会话、编排、上下文管理等底层基础设施,应用开发者则可以专注于自身业务所需的工具、知识和工作流程。

在技术实现上,Agents API具备三大关键能力:首先,系统支持上下文自动压缩,在会话接近上下文窗口上限时自动对早期内容进行优化,使代理可持续运行数小时乃至数天;其次,提供工具搜索与并行调用功能,按需加载相关工具定义以降低token消耗,并支持并行执行多个工具调用;最后,支持多代理协同,主代理可将复杂任务分解后下发至多个并行运行的子代理,各子代理独立维护上下文,最终由主代理汇总结果。

物流科技公司Nash表示,其平台通过Agents API部署了数千个长时运行的AI代理,负责管理全球数亿次配送任务,代理运行周期可横跨数小时乃至数天。建筑及居家服务领域的AI平台Long Lake也表示,借助该API,团队现可在数小时内跨行业部署代理,而非此前所需的数天周期。
在计算环境层面,Agents API提供多种部署选项。OpenAI提供自托管沙盒,与Codex及ChatGPT共用同一沙箱基础设施,支持快速启动与弹性扩展;同时,OpenAI已与Blaxel、Cloudflare、Daytona、DigitalOcean、E2B、Modal、甲骨文、Runloop及Vercel等生态合作伙伴达成一级集成协议,为开发者提供涵盖私有云部署、特定存储机制以及不同CPU、GPU与内存配置的差异化选项。
值得注意的是,Agents API基于开源的Codex执行框架构建,开发者可查阅其公开代码库以了解模型调用、工具协调与上下文管理的核心逻辑。OpenAI负责维护并持续优化该框架,开发者在每次模型升级时可自动获益,无需自行重构代理架构。
目前Agents API已向所有开发者开放公测,不额外收取API使用费用,用户仅需按照所使用的模型Token和工具付费。OpenAI表示,公测期间将根据开发者反馈快速迭代,并逐步推进正式发布。