对企业而言,挑战已不再是证明 AI 智能体能发挥作用,而是让它们在生产环境中可靠地承担高价值工作。随着产品、政策和用户行为变化,智能体行为也必须随之调整。这需要的不只是模型:还需要系统、评估和部署经验,才能在这些条件变化时持续改进智能体,同时不放弃控制权。
我们推出 OpenAI Presence,这是一款经过实战检验的产品,帮助企业部署可信的 AI 智能体,用于回答问题、解决事件、使用公司系统、执行已批准的操作,并在需要时转接给人工。经过多年与企业级客户合作验证,Presence 将模型推理与政策、护栏和转接规则相结合,用于验证准确性和性能。
每次部署都从一项具体任务开始,例如解决账单问题、支持保险理赔,或处理员工 IT 服务请求。智能体只会获得完成该任务所需的知识和系统访问权限。由企业设定政策:智能体可以做什么、何时需要批准,以及何时应由人工接管。上线后,生产会话和转接处理会暴露差距。Codex 会提出更新,团队可以测试并批准,帮助智能体随着客户行为变化而适应。
OpenAI 会与每位客户并肩合作,识别每个高价值工作流,连接所需知识和系统,建立权限与政策,测试智能体,并将其投入生产。随着部署范围扩大,OpenAI 和精选系统集成商可继续提供支持。Presence 与 OpenAI 研究团队紧密协作开发而成;每次部署中泛化出的洞见都会为持续的研究和产品开发提供参考,并随着时间推移为所有客户改进产品。
如今,Presence 支持语音和聊天中的实时体验,例如客户支持、外呼销售和高风险内部工作流。客户可以用它解决账单问题——从理解请求、验证客户身份,到查找账户信息、应用公司政策并执行已批准的操作。
企业可以决定哪些内容在不同部署中保持一致——如政策、评估和转接规则——哪些内容应随每个工作流或渠道而变化。这样,团队就能复用有效做法,并扩展到新的用例,而无需从头开始。
Presence 汇集了团队在生产环境中运行智能体所需的组件:政策和标准操作流程、护栏、已批准的操作、模拟、评估工具,以及由 Codex 驱动的改进流程。
这些组件共同帮助团队连接企业系统、定义智能体应如何行动、评估性能、执行政策,并在上线后管理变更。

Presence 是一款富有雄心的产品,在多年与客户一起部署智能体的实践中打造,并由关键任务环境的需求塑造而成。每次部署都会产生洞见,持续为 OpenAI 的研究和产品开发提供参考,为客户带来复合式收益。
Presence 为 OpenAI 的英语电话支持渠道 1-888-GPT‑0090 提供支持,可处理开放式请求、验证来电者、使用账户上下文,并执行已批准的操作。在数周内,它达到或超过了我们用于评估一线人工支持质量的基准,如今无需人工协助即可解决 75% 的来电问题。通过与我们的上线团队合作,其由 Codex 驱动的改进循环在短短 10 天内将人工转接减少了 15 个百分点。
领先企业也正在基于同一套经过验证的基础进行构建:
- BBVA 正在墨西哥探索由 AI 驱动的日常银行业务语音支持。
- SoftBank 正在测试自然的日语客户对话。
- IAG 正在探索在恶劣天气等高需求事件期间提供及时支持。
在 Presence 部署面向用户之前,团队可以用常见请求、边缘情况和较高风险场景对其进行测试。模拟和评分器会检查它是否达成了正确结果、遵循了政策、正确使用了工具,并在适当时候转接。当交互超出企业边界时,护栏可以介入。

这项工作不会在上线时停止。随着政策、产品和用户行为变化,生产会话、转接记录和质量信号可以帮助团队了解智能体哪里运行良好、哪里需要关注。Codex 会使用 Presence 插件调查这些信号并建议更新。团队可以将每项拟议变更与生产版本进行对照测试,然后批准受控发布。
Presence 也被设计为与你共同学习——在业务、客户和员工不断演进时持续改进,同时让企业保持控制权。它基于 OpenAI 世界一流的研究构建,并会随着我们的模型和能力提升而持续进步。当某个用例超出当前产品支持范围时,OpenAI 前线部署工程师 (FDE) 和合作伙伴可以与客户合作,将其投入生产。

OpenAI Presence 现通过有限范围公开可用计划,作为已部署产品向符合条件的企业客户提供。部署由 OpenAI 前线部署工程师和精选全球系统集成商负责。Presence 目前尚不作为自助式产品提供。
在推出 OpenAI Presence 的同时,我们将继续通过 OpenAI API,支持语音客户访问我们的前沿模型。
如需探讨 Presence 是否适合您的组织,请联系您的 OpenAI 客户团队。


