SheepNav
新上线2天前56 投票

WebMCP:让你的网站学会与AI智能体对话

想象一下,AI智能体帮你在餐厅网站预订座位。今天,它就像一个耐心但有点迷糊的实习生:加载页面、阅读原始HTML、在几十个

元素中寻找日期选择器、猜测绿色按钮意味着“确认”、点击、等待、再重新阅读整个屏幕看是否生效。下周按钮移动了,智能体就失效;CSS类名改了,它失效;多了个Cookie横幅,它就点错地方。这就是目前几乎所有“智能体使用网站”的方式——屏幕抓取加碰运气,相当于通过电话描述截图来操作电脑。

WebMCP提出了更合理的方案:与其让智能体盯着页面猜测网站能做什么,不如让网站直接声明自己能做什么——以一组干净、结构化的工具形式,供智能体直接调用。“这是一个book_table工具,接受日期、时间和人数参数,直接调用即可。”无需解析像素,无需猜测。更妙的是,它已经在Chrome中试运行,添加第一个工具只需大约十分钟。

核心转变:从抓取到声明

整个理念可以用一个对比概括:同一任务,两个世界。如果你读过我之前的MCP文章(让AI触达世界的端口),会觉得似曾相识。MCP为AI提供了在服务器上调用工具的标准方式,而WebMCP将同样的理念引入浏览器:网页本身成为提供工具的场所,运行在你已打开的标签页中,使用你已登录的会话。

它到底是什么

WebMCP是一个拟议的Web标准,由谷歌(Chrome)和微软(Edge)在W3C Web机器学习社区组联合开发,赋予网页一个JavaScript API,用于注册AI智能体可发现和调用的工具。Chrome文档中描述为“构建和暴露结构化工具供AI智能体使用”,网站标注自身功能,使智能体“确切知道如何交互”。需要明确的是,目前还是社区组草案,并非正式W3C标准,也未进入标准轨道,这正是现在学习并参与塑造它的好时机。

三个关键要素

发现:页面标准方式声明“我提供这些工具”,如checkout或filter_results,智能体可列出它们。

模式:每个工具定义清晰的输入输出结构,智能体无需猜测参数。

执行:工具在页面上下文中运行,利用现有会话和状态,无需额外跳转。

为什么值得关注

WebMCP有望成为智能体与网站交互的新标准,减少脆弱性,提升效率,让AI代理真正“理解”网站功能。对于开发者,这是学习前沿技术、参与标准制定的机会;对于企业,这意味着未来AI服务能更顺畅地接入现有网站。

尽管尚处早期,但Chrome试运行已证明可行性。随着W3C推进,WebMCP可能成为AI时代Web的基础设施,值得密切关注。

延伸阅读

  1. 视频星期五:认识 Microduck
  2. Meta智能眼镜更新:限制非自愿录制,降低“偷拍”嫌疑
  3. AI 让人类医生自问:我们还能做什么?
查看原文