
1. 从手动复制粘贴到 OpenClaw 浏览器自动化我踩过的真实场景如果你每天的工作里有一半时间在浏览器里重复点击、翻页、复制表格那 OpenClaw 浏览器自动化值得你花一个下午认真配一次。OpenClaw 是一个开源本地 AI 代理早期叫 ClawdBot、MoltBot它的核心能力是「全系统访问 持久记忆 技能生态」说白了就是让一个跑在你机器上的智能体替你操作浏览器、抓数据、填表单、盯仪表盘。而浏览器自动化正是它最实用、也最容易上手的一环。我最初的需求很朴素每天早上去三个行业网站抓最新公告整理成 Markdown 丢进知识库。手动做要 40 分钟还容易漏。后来我把 OpenClaw 的四种浏览器自动化路径都试了一遍从纯 HTTP 抓取到 CDP 控制独立浏览器再到复用现有 Chrome 标签最后用 TaoToken 统一管理模型调用的 Key。这篇就把这四条路讲透每条都给可复制的配置和验证动作你照着做就能跑起来。适合谁看需要批量网页操作、数据采集、登录后自动化的开发者已经在用 OpenClaw 但不确定该选哪种浏览器方案的人以及想把模型 API 调用统一收口、不想在多个平台之间来回换 Key 的团队。下面按「问题场景 → 前置准备 → 可复制配置 → 验证结果 → 排错 → 收口」的顺序展开你可以直接跳到关心的那一段。2. OpenClaw 浏览器自动化前置准备与 TaoToken 统一 Key 通道在动手配四种方案之前先把底座搭好。OpenClaw 本身是本地代理它要调用大模型来理解页面、决定点哪里所以模型 API 的接入是绕不开的。我试过在多个平台分别申请 Key结果配置文件里散落着五六个不同格式的凭证换一个模型就要改一遍非常痛苦。后来我把模型调用统一走 TaoToken 的 API 通道一个 Key 覆盖多种模型配置文件干净了很多。TaoToken 在这里的角色是「统一 Key / API 通道」你不需要为每个模型单独维护一套鉴权Base URL 指向https://taotoken.net/apiKey 在控制台生成一次即可。对 OpenClaw 这种需要频繁切换模型抓取用便宜模型、复杂推理用强模型的场景统一通道能省掉大量重复配置。前置准备分三步。第一步确认本地环境Node.js 18、Python 3.10部分技能依赖、以及一个可用的 Chrome/Edge/Brave。第二步安装 OpenClaw 并初始化配置目录默认在~/.openclaw/下主配置文件是config.json。第三步去 TaoToken 控制台创建 API Key拿到形如sk-xxxx的凭证稍后写进配置。# 安装 OpenClaw以 npm 全局安装为例 npm install -g openclaw # 初始化配置会在 ~/.openclaw/ 生成 config.json openclaw init # 查看当前配置结构确认文件路径 ls -la ~/.openclaw/初始化完成后先别急着配浏览器把模型通道打通。编辑~/.openclaw/config.json在models段填入 TaoToken 的 Base URL 和 Key。注意 Base URL 用https://taotoken.net/api不要带多余路径。{ models: { default: gpt-4o-mini, providers: { taotoken: { baseUrl: https://taotoken.net/api, apiKey: sk-你的TaoToken密钥, models: [gpt-4o-mini, claude-3-5-sonnet, deepseek-chat] } } } }配好后跑一条最小验证确认模型通道可用再进入浏览器方案。这一步很关键因为后面四种方案都会调用模型如果通道不通你会误以为是浏览器配置的问题白白排查半天。# 最小验证让 OpenClaw 用默认模型回一句话 openclaw run --prompt 回复通道正常如果返回了「通道正常」说明 TaoToken 通道已经打通。接下来四种浏览器自动化方案都建立在这个底座之上。你可以按需选择也可以组合使用——比如公开数据用 web_fetch登录后的复杂操作用 Managed 浏览器。3. 四种 OpenClaw 浏览器自动化方案的可复制配置这一节是全文的核心四种方案我按「上手难度从低到高」排列每种都给完整配置片段和启动命令。你可以先全部读一遍再挑一个动手。3.1 方案一内置 web_fetch 工具无浏览器纯 HTTP 抓取web_fetch 是 OpenClaw 内置的轻量抓取工具逻辑是直接发 HTTP GET把 HTML 转成 Markdown 或纯文本。它不执行 JS所以速度快、零资源开销适合批量处理公开信息。配置只需在config.json里打开开关。{ tools: { web: { fetch: { enabled: true, timeoutMs: 15000, userAgent: Mozilla/5.0 (compatible; OpenClaw/1.0) } } } }也可以用命令行一键配置openclaw configure --section web验证动作下达一条抓取指令看是否返回 Markdown 正文。openclaw run --prompt 抓取 https://example.com 的正文输出前 200 字实测下来web_fetch 对静态页面几乎秒回但遇到 JS 重度渲染的页面会拿到空壳。这时候要么换方案三要么在配置里挂一个 Firecrawl 之类的兜底 API。它的最佳场景是新闻监控、报告批量下载、竞品价格监控这类不需要登录的公开数据。3.2 方案二API 搜索 SkillLast30Days 时效搜索如果你要的不是「抓某个页面」而是「最近 30 天全网关于某话题的讨论」那 API 搜索 Skill 更合适。以 Last30Days 为例它调用搜索 API 抓取社交平台和网页的近期内容支持定时生成简报。安装和配置如下。# 安装技能 clawhub install last30days # 配置搜索 API Key在 config.json 的 tools.web.search 段{ tools: { web: { search: { provider: brave, apiKey: 你的搜索API密钥, defaultWindowDays: 30 } } } }触发方式有两种聊天窗口直接输入/last30days 关键词或者配 Cron 定时任务。验证动作openclaw run --prompt /last30days OpenClaw 最近30天这个方案的优势是精准和时效成本可控免费额度通常够个人用。局限是依赖第三方 API有轻微延迟且非实时。适合舆情监控、竞品动态追踪、投资热点挖掘。3.3 方案三OpenClaw Managed 浏览器CDP Playwright 独立隔离这是四种方案里能力最强、也最接近「真正自动化」的一种。OpenClaw 启动一个独立的浏览器配置文件通过 CDP 协议配合 Playwright 全权控制支持无头模式、多配置并行能 7x24 小时跑。它和个人浏览器完全隔离登录态独立适合登录后的复杂操作。先启动独立浏览器openclaw browser --browser-profile openclaw start然后在config.json里配置 CDP 端口和默认 profile{ browser: { enabled: true, defaultProfile: openclaw, profiles: { openclaw: { cdpPort: 18800, headless: true, executablePath: /Applications/Google Chrome.app/Contents/MacOS/Google Chrome } } } }常用操作命令包括打开网页、快照、点击元素openclaw browser open https://example.com openclaw browser snapshot openclaw browser click --selector #login-button验证动作打开一个需要登录的页面用 snapshot 看是否拿到完整 DOM再执行一次点击确认交互生效。这个方案首次配置稍复杂需要装 Playwright 依赖但配好之后最稳。如果本地资源紧张可以搭配 Browserless 云端远程 CDP把浏览器跑在远端。3.4 方案四Relay Extension复用现有 Chrome 标签Relay Extension 是上手最快的一种装一个 Chrome 扩展加本地 Relay 服务直接接管你已经打开的标签不用新开浏览器直接复用已登录状态。适合快速验证流程、临时复杂操作、以及银行/交易所这类已登录重度网站的短时操作。# 安装扩展文件 openclaw browser extension install # 然后在 Chrome 访问 chrome://extensions开启开发者模式加载已解压的扩展激活方式固定扩展图标点击目标标签让徽章显示「ON」并在配置里把 profile 设为 chrome。{ browser: { defaultProfile: chrome, relay: { enabled: true, allowHostControl: true, target: host } } }注意Sandbox 模式下用 Relay Extension 必须配allowHostControl: true并指定target: host否则会连不上。它的局限是安全隔离性较弱且必须保持浏览器开启不适合长期无人值守。4. 验证请求与成功结果四种方案跑通后的对照配完不等于跑通这一节给你每种方案的验证动作和预期结果方便你对照排查。我建议按顺序验证先确认模型通道再逐个测浏览器方案。对于 web_fetch成功标志是返回结构化的 Markdown 正文且耗时在 1-3 秒内。如果返回空或超时先检查目标页面是否依赖 JS 渲染再检查timeoutMs是否太短。对于 API 搜索 Skill成功标志是返回带时间戳和来源链接的条目列表。如果返回 401多半是搜索 API Key 没配对如果返回空列表检查关键词和defaultWindowDays设置。对于 Managed 浏览器成功标志是openclaw browser snapshot输出完整 DOM 树且click命令能触发页面变化。如果 CDP 连不上检查cdpPort是否被占用以及浏览器是否真的启动了。对于 Relay Extension成功标志是扩展徽章显示「ON」且 OpenClaw 能读到当前标签的 URL 和 DOM。如果徽章不亮检查扩展是否加载成功、Relay 服务是否在跑。下面这张对照表帮你快速选型对比维度web_fetchAPI 搜索 SkillManaged 浏览器Relay Extension操作难度低中中低隔离性高高最高良好24/7 运行优秀优秀顶级一般成本免费低免费/按需免费核心优势速度快、批量精准时效稳定隔离、复杂交互快速上手、复用登录态最佳场景公开数据采集舆情监控长期自动化临时验证验证通过后建议把配置备份一份。自动化流程最怕配置丢失导致中断我习惯把~/.openclaw/config.json纳入版本管理每次改动都留痕。5. 本篇常见报错排查401、local proxy failed、reading choices、OAuth这一节是我实际踩过的坑按报错信息对照排查能省你不少时间。401 Unauthorized最常见于模型通道或搜索 API。先确认 TaoToken 的 Key 是否写对、有没有多余空格再确认 Base URL 是https://taotoken.net/api不要写成带/v1的路径。如果 Key 没问题检查账户额度是否用尽。local proxy failed通常出现在 Relay Extension 或 Managed 浏览器启动时。原因是本地 Relay 服务没起来或者端口被占用。解决方法是先确认 Relay 进程在跑再检查cdpPort和 Relay 端口是否冲突。Sandbox 模式下还要确认allowHostControl: true和target: host都配了。reading choices 报错这是模型返回格式不符合预期导致的多见于用便宜模型做复杂页面理解时。解决方法是换一个能力更强的模型或者在 prompt 里明确要求输出 JSON 结构。如果你用 TaoToken 统一通道切换模型只需改配置里的default字段不用换 Key。OAuth 相关报错出现在需要登录的自动化场景。Managed 浏览器首次登录需要手动完成一次 OAuth 授权之后登录态会保存在独立 profile 里。如果反复弹授权检查 profile 目录是否有写权限以及是否每次启动都用了不同的 profile。Codex auth.json 相关如果你同时用 Codex 类工具注意它的auth.json和 OpenClaw 的config.json是两套凭证。出现鉴权冲突时确认两者的 Base URL 和 Key 没有互相覆盖。三件套要写全Base URL、Key、Model ID缺一个都可能报错。排错时我习惯先跑最小验证把问题范围缩小到「模型通道」还是「浏览器控制」。模型通道的问题看 401 和 reading choices浏览器控制的问题看 local proxy failed 和 OAuth。分清楚这两类排查效率会高很多。6. 用 TaoToken 统一管理 API 调用从配置到长期运行四种方案跑通之后最后一个要收口的是 API 调用的统一管理。OpenClaw 的浏览器自动化会频繁调用模型——抓取时用便宜模型做摘要复杂交互时用强模型做决策。如果每个模型都单独配 Key配置文件会越来越乱团队协作时更是灾难。TaoToken 的统一 Key 通道解决的正是这个问题一个 Key、一个 Base URL覆盖多种模型。你只需要在config.json的providers段维护一份凭证切换模型时改default字段即可。对长期运行的自动化任务这意味着更少的配置漂移和更低的维护成本。如果你要跑 7x24 的长期编码或 Agent 任务可以了解 Coding Plan它更适合持续性的自动化负载。需要生成和管理 Key 就去控制台接入细节看接入文档。想先验证模型效果可以直接在模型对话里试。Claude Code 相关的接入可以参考 ClaudeCodeAnthropic 的说明。最后给一个实用技巧把 OpenClaw 的配置和 TaoToken 的 Key 分开管理Key 走环境变量注入配置文件里只留占位符。这样备份配置时不会泄露凭证团队共享时也更安全。# 用环境变量注入 Key配置文件里写 ${TAOTOKEN_API_KEY} export TAOTOKEN_API_KEYsk-你的密钥 openclaw run --prompt 用默认模型抓取 https://example.com 并摘要配好之后你的 OpenClaw 就能在四种浏览器自动化方案之间自由切换而模型调用始终走同一条通道。从手动复制粘贴到 7x24 自动运行中间隔的就是这一套配置。