OpenAI 已开放 WebMCP 挑战赛的注册和提交,这是一项围绕实验标准建立的开发者竞赛,旨在使网站可供 AI 代理直接使用。此举不仅仅是一场竞赛。这是一个信号,表明 OpenAI 希望支持代理的网站公开结构化操作,而不仅仅是人类可读的页面。
OpenAI 将 WebMCP 描述为一种开放标准,允许网站发布代理可以直接调用的工具。 OpenAI 自己的支持文档称,ChatGPT 的桌面站点工具使用 WebMCP,允许 ChatGPT 在访问、模型资格和网站支持一致时,与在其内置浏览器中打开的受支持网站配合使用。
这改变了代理工作流程的集成界面。网站可以以更明确的方式描述可调用功能,而不是要求代理从按钮、表单和页面布局推断意图。对于开发者、SaaS 运营商和 API 平台来说,重要的问题不再仅仅是模型是否可以浏览网站。问题在于网站是否可以安全地呈现允许代理发现、调用和记录的操作。
发生了什么变化
WebMCP 挑战赛于 2026 年 8 月 25 日开幕,OpenAI 邀请开发人员构建代理就绪的网站工具。该公司将 WebMCP 视为实验性的,因此不应将其视为已确定的 Web 标准。但时机很重要,因为 OpenAI 将该概念与真实的 ChatGPT 桌面行为联系起来,而不是将其视为纯粹的理论协议。
OpenAI 的帮助文档称 ChatGPT 桌面站点工具受帐户、模型和网站支持的限制。这意味着可用性会有所不同。用户可能会在一种环境中看到网站工具的行为,而在另一种环境中则看不到,网站需要选择相关的工具公开。 《搜索引擎杂志》还于 8 月 27 日报道,ChatGPT 的桌面浏览器可以使用 WebMCP 站点工具,这强化了这一点正在进入面向用户的产品工作流程。
实际区别在于浏览器自动化和工具调用之间。传统的浏览器代理与页面的交互就像人类一样,通过可视化界面进行点击和输入。 WebMCP 指向了一种不同的模式:网站可以公开描述代理可以做什么的结构化操作。这可以使操作更容易验证,但也提高了权限和产品设计的风险。
为什么这对开发人员很重要
对于 Web 团队来说,WebMCP 在公共 API、用户界面和现有插件或应用生态系统旁边引入了一个新的集成层。站点可能需要定义哪些操作应该是代理可调用的、这些操作接受哪些参数、身份验证如何工作以及如何向代理解释失败。
这对产品工程有直接影响。结帐流程、预订系统、分析仪表板或内容管理工具可能不希望向代理公开每个用户可见的操作。有些行动可以安全起草,但不能提交。其他人可能需要确认、角色检查或管理员批准。如果网站可以由代理调用,“查看”、“准备”、“修改”和“提交”之间的差异将成为产品安全边界。
它还会改变可观察性要求。团队需要知道代理何时调用站点工具、哪个帐户授权了它、传递了哪些输入以及操作是否更改了状态。这种审计跟踪在 API 基础设施中很常见,但许多基于浏览器的工作流程在构建时并未考虑到代理发起的工具调用。
对于使用 Model Gate 或类似的多模型基础设施进行构建的开发人员来说,这种连接是间接的,但很重要。代理应用程序越来越多地跨越模型调用、服务器端工具、浏览器端工具和合作伙伴 API。统一的人工智能 API 可以路由模型请求,但更广泛的系统仍然需要围绕代理可以调用哪些工具以及如何归因花费、延迟和故障进行治理。 WebMCP 使治理更接近网站本身。
谁受到影响
第一个受影响的群体是网站和 SaaS 开发人员,他们希望自己的产品在 ChatGPT 或其他代理浏览器中正常运行。他们最终可能需要将代理准备就绪视为平台策略的一部分,就像许多团队曾经处理 REST API、Webhooks 或 OAuth 集成一样。
企业安全和合规团队也受到影响。结构化工具模式比自由形式的屏幕自动化更容易检查,但它仍然可以触发真正的业务操作。如果代理可以通过网站工具创建票证、更新记录、发送消息、更改设置或下订单,那么公司将需要在执行之前而不是事后进行策略控制。
代理和服务提供商也应密切关注这一点。越多的网站公开可代理调用的工具,自动化工作就越多地从自定义抓取和脆弱的 UI 脚本转向集成设计、权限建模和工作流程编排。这对合作伙伴 API 自动化、经销商平台和向客户提供托管 AI 工作流程的团队产生了影响。
对于 AI 网关供应商来说,WebMCP 是网关类别正在扩展到模型路由之外的另一个标志。模型选择、API 密钥管理和人工智能使用分析仍然是必要的,但代理需要更广泛的控制平面,能够跨多个执行环境了解工具发现、授权和可审核性。
仍然不确定的
最大的不确定性是标准化。 OpenAI 将 WebMCP 称为实验性的,其广泛采用将取决于网站所有者、框架提供商和竞争的 AI 客户是否认为该方法足够有用以实施。挑战可以播种示例,但不能保证生态系统达成共识。
可用性在设计上也参差不齐。 OpenAI 的文档将访问描述为由帐户、模型和网站支持控制,这意味着开发人员应避免假设每个 ChatGPT 用户都可以立即调用 WebMCP 工具。依赖于这种行为的产品团队将需要优雅的回退。
还有一个未解决的治理问题。结构化工具可以减少歧义,但它们不会自动解决同意、授权或滥用预防问题。网络长期以来一直依赖于为人类设计的界面。让自主或半自主代理可以调用这些相同的业务需要更明确的合同,规定代理可以做什么、在谁的权限下以及执行的记录如何。
即使实施较早,方向也是明确的。 OpenAI 的 WebMCP 工作表明,代理就绪网站可能成为真正的集成目标,而不仅仅是演示模式。获胜者将是那些将工具公开视为基础设施的团队:版本化、可观察、获得许可并且专为失败而设计。