阅读要点
先读这里,快速了解全文在讲什么
核心结论
想让 Agent 真的会点网页,最常翻车的地方就是截图猜坐标——页面一改版,整段自动化就废。playwright-mcp 换了个路子:把浏览器的无障碍树喂给模型,让它像读文档一样读页面。写后端脚本的、做 Agent 产品的、每天跟后台表单打交道的,都值得点进去看一眼。核心看点不靠像素靠结构:它把 Playwright 的无障碍快照暴露成 MCP 工具,模型看到的是一份带角色和元素引用的清单,点谁、填谁都按引用走,比纯视觉方案稳得多。工具…
你可以了解到
阅读后可获得与「playwright-mcp:让AI用无障碍树操控浏览器,少走截图弯路」相关的实用信息与站内延伸资源;最后更新 2026年9月17日。
延伸阅读
想让 Agent 真的会点网页,最常翻车的地方就是截图猜坐标——页面一改版,整段自动化就废。playwright-mcp 换了个路子:把浏览器的无障碍树喂给模型,让它像读文档一样读页面。写后端脚本的、做 Agent 产品的、每天跟后台表单打交道的,都值得点进去看一眼。
核心看点
不靠像素靠结构:它把 Playwright 的无障碍快照暴露成 MCP 工具,模型看到的是一份带角色和元素引用的清单,点谁、填谁都按引用走,比纯视觉方案稳得多。工具链够日常:导航、点击、填表、上传文件、执行 JS、抓网络请求、截图都收在同一套 MCP 接口里,接上支持 MCP 的客户端就能用。背后是微软:Apache-2.0,更新基本跟着 Playwright 走,Issue 和 PR 都有人接。

上手提示
典型用法是让 AI 替你跑重复的网页动作:登录后台导数据、按模板批量填表、做端到端检查。需要 Node.js 环境,用 npx 起服务,然后在 VS Code、Claude Desktop 这类客户端里注册即可;要不要无头、用哪个浏览器频道,都有参数可调。这个服务本身不强制 API Key,真正调模型的是客户端那一侧。第一版建议先在测试站上跑通再引入项目。
README 里写了各客户端的配置样例,Releases 也能快速看出最近改了哪块。想先跑通再决定要不要用,直接翻 playwright-mcp 仓库。

