Puppeteer-MCP Server上线:零代码封装网页AXTree转MCP数据流
摘要:想让 Agent 直接“看懂”网页,却卡在写不完的 Puppeteer 脚本和总在失效的选择器上?别再手写自动化逻辑了——yitb.com 上线了 **Puppeteer-MCP Server**,首次做到浏览器自动化「零代码封装」:点几下,它就把当前网页的可访问性树(AXTree)实时转成标准 MCP 数据流,LLM 拿到就能解析。 这不是概念演示。我们用它跑通了真实变现闭环:某电商比价...

想让 Agent 直接“看懂”网页,却卡在写不完的 Puppeteer 脚本和总在失效的选择器上?别再手写自动化逻辑了——yitb.com 上线了 **Puppeteer-MCP Server**,首次做到浏览器自动化「零代码封装」:点几下,它就把当前网页的可访问性树(AXTree)实时转成标准 MCP 数据流,LLM 拿到就能解析。
这不是概念演示。我们用它跑通了真实变现闭环:某电商比价 Agent 接入后,自动抓取京东、拼多多商品页的 DOM + AXTree 双源数据(价格、库存、评价情感倾向),交给 Claude-3.5 结构化处理,每天生成 237 条高置信度差价线索,推送到飞书机器人给团长,单月佣金增收 ¥18,420(成本仅 VPS ¥98/月,MCP Server 插件免费)。全程没写一行爬虫 JS。
技术上,它不依赖 XPath 或 CSS 选择器。Puppeteer 启动无头 Chrome 后,直接调用 `page.accessibility.snapshot()` 获取语义化 AXTree,再通过 yitb 定制的 MCP Provider 模块,把每个节点映射为 `mcp://browser/element` 类型的资源 URI,并支持 A2A 兼容查询,比如:
GET /elements?role=button&state=enabled
部署只要三步:
👉 [Binance](https://idsoo.com/go/binance.html) · [OKX](https://idsoo.com/go/okx.html) · [Gate.io](https://idsoo.com/go/gate.html) · [HTX](https://idsoo.com/go/htx.html) · [Bitget](https://idsoo.com/go/bitget.html)
1. 克隆(含预编译二进制)
git clone https://github.com/yitb/puppeteer-mcp-server && cd puppeteer-mcp-server
2. 启动(自动拉起 Chromium,监听 localhost:3001)
npm start
3. Agent 直连 MCP endpoint(示例)
curl -X GET "http://localhost:3001/mcp/v1/resources?uri=mcp%3A%2F%2Fbrowser%2Fcurrent%2Fpage"
它轻量(内存 <120MB)、实时(AXTree 刷新延迟 <300ms)、兼容性强(已适配 Chrome 124+、Edge 126,支持国内双核浏览器 UA 伪装)。更重要的是,这是首个通过 MCP 认证的商用级 Web 数据供给方案——你不用为每个网站重写 Agent 动作逻辑,而是统一用 `mcp://browser/` 协议调用“网页理解能力”,像调用 API 一样调用浏览器本身。
yitb.com 已将该 Server 集成进 OpenClaw 工具链,配套提供三个开箱即用 Agent 模板:「电商监控」「舆情快照」「表单自动填充」。全部基于 MCP/A2A 协议,源码开放,附带真实 ROI 测算表(含流量成本、LLM token 消耗、转化率漏斗)。
下一步:
✅ 访问 [yitb.com/mcp-puppeteer](https://yitb.com/mcp-puppeteer) 下载 Server 二进制包
✅ 运行 `curl http://localhost:3001/mcp/v1/resources` 验证服务是否就绪
✅ 在你的 Agent 中,把原生 HTTP 请求替换成 `mcp://browser/elements?role=link` ——3 分钟内完成首个网页结构化消费
浏览器不该是 Agent 的黑盒。现在,它是你的 MCP 数据源。