Pagehand

能动手操作当前网页的 AI。

Chrome 侧栏助手。读取页面、点击、填写表单,并查看控制台与网络 — 通过 CDP,使用你自己的 API 密钥。

Manifest V3 · chrome.debugger · 自带 OpenAI / Anthropic / DeepSeek 密钥

几步就能装进 Chrome。

不用装 Node,也不用自己编译。下载 Release 压缩包,解压后作为「已解压的扩展程序」加载即可。

  1. 下载

    从最新 GitHub Release 下载 pagehand.zip

  2. 解压

    解压到一个你会长期保留的文件夹。Chrome 每次启动都会读取这个文件夹,装完后不要删掉。

  3. 打开扩展程序页

    在 Chrome 地址栏输入 chrome://extensions,回车。

  4. 打开开发者模式

    在页面右上角打开 开发者模式 开关。

  5. 加载已解压的扩展程序

    点击 加载已解压的扩展程序,选中刚才解压出的文件夹 (里面应有 manifest.json)。

  6. 打开 Pagehand

    点击工具栏拼图图标,固定 Pagehand,打开侧栏,在设置里填入你的 API 密钥即可开始。

以后更新:下载新的 zip,覆盖原文件夹内容,再到 chrome://extensions 点一下刷新图标。 想自己从源码构建? 看 GitHub 说明

侧栏直接拥有调试器。

无需 Node 旁路进程,也无需 MCP 桥接。Pagehand 在扩展内部直接对话 Chrome DevTools Protocol,驱动你正在看的网页。

  1. 打开侧栏

    /Ctrl+Shift+K,或点击工具栏图标。

  2. 填入密钥

    默认 DeepSeek — OpenAI、Anthropic 或任意 OpenAI 兼容端点均可。

  3. 让它动手

    总结页面、点击、填表、追查控制台错误,或在真实页面上走完多步流程。

与 Puppeteer 同一套协议。

无障碍树快照、输入、导航、截图、控制台与网络 — 直接对接 CDP 域实现,而不是脆弱的 DOM 抓取。

  • take_snapshot

    以结构化无障碍树读取页面,带稳定 uid。

  • click / fill / type

    像真人一样操作表单与界面 — 包括替换前先全选。

  • navigate / pages

    在网页间跳转并管理页面,Agent 保持上下文。

  • console / network

    无需亲自打开 DevTools,即可查看错误与请求。

  • evaluate_script

    读树不够时,运行针对性的页面脚本。

  • take_screenshot

    捕获网页画面,并保留在对话线程中。

你的密钥不会经我们的服务器离开本机。

Pagehand 没有后端。API 密钥保存在 chrome.storage.local 中,仅发送给你选择的模型提供商。附着调试时,Chrome 会显示 「Pagehand is debugging this browser」横幅 — 这是有意为之,且无法隐藏。 阅读完整隐私政策 →