必须先安装agent-browser模块,否则执行网页抓取会报“no browser context”错误;运行npx clawhub install agent-browser后,再执行openclaw nanobot start启动服务。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

确认AionClaw已启用浏览器自动化能力
打开AionClaw客户端后,若直接执行网页抓取指令失败,大概率是未激活agent-browser模块——这是所有页面交互、动态渲染、表单填写功能的底层依赖。【必须先安装该模块,否则后续所有操作都会报“no browser context”错误】
在终端中运行命令:npx clawhub install agent-browser。等待提示“agent-browser v2026.3.31 installed successfully”后,执行openclaw nanobot start启动智能体服务。
这一步不能跳过,哪怕你刚装完AionClaw也得手动补上。官网一键部署流程虽快,但agent-browser默认不预装,这是为降低首次启动资源占用做的设计取舍。
用自然语言指令启动单页抓取任务
不需要写代码,不用记XPath,直接在AionClaw主界面右下角的对话框输入指令:
“打开https://example-shop.com/products,等待.product-card元素全部加载完成,提取每个卡片里的h3.title文本、span.price数字、a[href]链接,保存为CSV”
按下回车后,AionClaw会自动拉起Chromium内核,执行页面渲染→等待指定元素出现→逐个定位并提取字段→结构化组装→导出文件。整个过程约8–15秒,取决于网络与目标站JS加载速度。
注意:如果目标页有登录态要求,指令中必须明确写出登录动作,例如“先打开https://admin.site.com/login,填用户名admin,密码${ADMIN_PASS},点击登录按钮,再跳转到/products页”。
处理多页并行抓取与分页滚动
电商列表页常含懒加载或无限滚动,AionClaw提供两种可靠路径:
方法一:显式滚动触发
“打开https://mall.a.com/list,向下滚动5次,每次间隔1.2秒,等待.product-item新增出现,提取全部h2.name和div.current-price”
方法二:多标签页并行抓取
“并行打开https://shop.a.com/page/1、https://shop.a.com/page/2、https://shop.a.com/page/3;等待.content-list容器加载;分别提取每页的.item-title和.item-price;合并去重后导出competitor_20260921.csv”
滚动次数和间隔时间必须写具体数值,不能写“滚动到底部”——因为AionClaw无法判断何为“底”,它只认可可量化的操作指令。这个细节很多人第一次试就卡住。
配置自动去重与增量保存
第一步:在AionClaw左侧导航栏点击「定时任务」→「新建任务」→粘贴你的抓取指令。
第二步:勾选「启用增量模式」,设置「去重字段」为“商品链接”或“SKU编码”(必须是唯一标识字段)。
第三步:在「保存路径」中使用变量模板:/Users/you/data/reports/${SITE}_${DATE:YYYYMMDD}.csv。AionClaw会自动替换日期,避免文件覆盖。
第四步:点击「设为每日执行」→选择凌晨2:15触发。此时AionClaw会在本地维护一个轻量级SQLite索引库,仅保存本次新增记录,不重复写入历史数据。
【去重字段一旦选错(比如选了可能重复的“商品名称”),会导致数据丢失且不可逆】











