
OpenAI 发布 AgentKit,一套完整的代理构建、部署与优化工具集。包含 Agent Builder、Connector Registry、ChatKit 三大组件,以及增强的 Evals 评估能力和强化微调(RFT)功能。通过可视化工作流设计、集中连接管理和嵌入式聊天 UI,大幅降低代理开发门槛,加速从概念到生产的部署周期。
2025年10月6日,OpenAI 正式推出 AgentKit,这是一套面向开发者和企业的完整工具集,旨在简化代理(Agent)的构建、部署与优化流程。在此之前,构建代理往往需要拼凑碎片化工具——复杂的编排缺乏版本控制、自定义连接器、手动评估流程、提示词调优以及数周的前端开发工作。AgentKit 通过提供可视化工作流设计、嵌入代理 UI 等新型构建模块,彻底改变了这一局面。 重要更新:2026年6月3日,OpenAI 宣布将逐步关闭 Agent Builder 和 Evals 产品。自2026年11月30日起,这些功能将不再在 OpenAI 平台上可用。对于需要持续以代码形式运行的工作流,官方推荐使用 Agents SDK;对于更适合自然语言提示的场景,建议使用 ChatGPT 中的 Workspace Agents。
AgentKit 包含三大核心组件:
Agent Builder:可视化画布,用于创建和版本化管理多代理工作流。
Connector Registry:集中管理面板,让管理员统一管理跨 OpenAI 产品的数据和工具连接。
ChatKit:工具包,用于在产品中嵌入可定制的聊天式代理体验。 同时,OpenAI 还扩展了评估能力,新增数据集、轨迹评分、自动提示优化以及第三方模型支持等功能,帮助开发者衡量和改进代理性能。
到 AgentKit 自2025年3月发布 Responses API 和 Agents SDK 以来,OpenAI 见证了开发者和企业构建端到端代理工作流的巨大热情,应用场景涵盖深度研究、客户支持等。例如:
Klarna 构建的支持代理处理了三分之二的客服工单。
Clay 通过销售代理实现了10倍增长。 AgentKit 基于 Responses API 构建,帮助开发者更高效、更可靠地开发代理。
设计工作流 随着代理工作流日益复杂,开发者需要更清晰的流程可视化。Agent Builder 提供可视化画布,支持拖拽节点组合逻辑、连接工具、配置自定义护栏。它支持预览运行、内联评估配置以及完整的版本控制,非常适合快速迭代。 开发者可以从空白画布或预置模板开始。
“Agent Builder 将曾经需要数月时间完成的复杂编排、自定义代码和手动优化,缩短到仅需几个小时。可视化画布让产品、法务和工程团队保持同步,将迭代周期缩短了70%,让代理在两个冲刺周期内上线,而不是两个季度。”—— Ramp
“Agent Builder 让我们以全新的方式编排代理,工程师和领域专家可以在同一个界面中协作。我们在不到两小时内构建了首个多代理工作流并成功运行,显著加速了代理的创建和部署。”—— LY Corporation(日本领先的科技与互联网服务公司)
与 Guardrails OpenAI 还推出了 Connector Registry,帮助企业跨多个工作区和组织治理和维护数据。该注册表将数据源整合到一个管理面板中,支持 ChatGPT 和 API 的集中管理。注册表包含所有预置连接器,如 Dropbox、Google Drive、SharePoint 和 Microsoft Teams,以及第三方 MCP。 开发者还可以在 Agent Builder 中启用 Guardrails——一个开源、模块化的安全层,帮助保护代理免受意外或恶意行为的影响。Guardrails 可以屏蔽或标记 PII、检测越狱攻击,并应用其他安全措施。Guardrails 可独立部署,或通过 Python 和 JavaScript 的 guardrails 库使用。
嵌入代理聊天体验 部署代理的聊天 UI 可能异常复杂——处理流式响应、管理线程、展示模型思考过程以及设计引人入胜的聊天内体验。ChatKit 简化了这一过程,让嵌入的聊天式代理感觉像产品原生功能。它可以嵌入到应用或网站中,并根据主题或品牌进行定制。 > “我们使用 ChatKit 为 Canva 开发者社区构建支持代理,节省了超过两周的时间,并且在一小时内完成集成。这个支持代理通过将文档转化为对话式体验,彻底改变了开发者与我们文档互动的方式,让在 Canva 上构建应用和集成变得轻而易举。”—— Canva ChatKit 已支持多种用例,包括内部知识助手、入职指南、客户支持和研究代理。HubSpot 的客户支持代理就是一个很好的例子。
Evals 功能衡量代理性能 构建可靠、生产就绪的代理需要严格的性能评估。去年,OpenAI 推出了 Evals,帮助开发者测试提示并衡量模型行为。现在,OpenAI 新增了四项功能,使构建评估更加便捷:
数据集:从零开始快速构建代理评估,并通过自动评分器和人工注释随时间扩展。
轨迹评分:对代理工作流进行端到端评估,并自动化评分以定位缺陷。
自动提示优化:基于人工注释和评分器输出生成改进后的提示。
第三方模型支持:在 OpenAI Evals 平台内评估来自其他提供商的模型。 客户已通过 Evals 获得了显著的性能提升。 > “评估平台将我们多代理尽职调查框架的开发时间缩短了50%以上,并将代理准确率提高了30%。”—— Carlyle
强化微调(RFT)允许开发者定制 OpenAI 的推理模型。该功能已在 OpenAI o4-mini 上全面可用,并在 GPT-5 上处于私有测试阶段。OpenAI 正在与数十家客户密切合作,在更广泛发布前完善 GPT-5 的 RFT。
AgentKit 的发布标志着 OpenAI 在代理开发领域迈出了重要一步。通过提供可视化工作流设计、集中连接管理、嵌入式聊天 UI 以及强大的评估和微调工具,AgentKit 显著降低了构建高质量代理的门槛。无论是初创公司还是大型企业,都能从中受益,加速从概念到生产的代理部署周期。
Bingdada 是一个专注 SEO、GEO(生成式引擎优化)与 AEO(答案引擎优化)的内容平台,由资深内容编辑、SEO 技术工程师与 AI 研究专家组成的团队持续运营。我们追踪搜索引擎与生成式 AI 的最新动态,为读者提供准确、实用、可落地的方法论与行业洞察。 编辑团队:内容策划 · 技术编辑 · AI 研究组 网站:bingdada.com © 2026 Bingdada. 保留所有权利。
SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

OpenAI因模型网络能力逼近关键门槛而调整开发策略,强调安全需贯穿训练全周期。文章解析其技术升级,并对比国内AI安全建设路径。

OpenAI与CodeAI宣布合作,通过ChatGPT for Teens及系列教育项目,弥合青少年AI使用与理解之间的鸿沟,培养具备批判性思维和负责任的AI原生一代。

Stampli 通过整合 OpenAI 的 Codex 与 ChatGPT Work,将产品发布工时压缩 68%,并构建了日常 AI 驱动营销系统。本文深入分析其工作流、角色转变及对国内 B2B 营销的借鉴意义。
获取最新的 SEO 与 GEO 技术资讯。
我们尊重您的隐私,随时可以取消订阅。