AionClaw需配置定时触发、页面识别与字段提取三者协同实现无人值守网页数据抓取;须安装agent-browser和web-scraper模块,启用列表识别并标注模板区块,排除干扰项后设置定时计划、CSV导出路径及失败通知,最后保存启用任务。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要让AionClaw在无人值守状态下定期从指定网页提取标题、价格、发布时间等结构化数据,而不是每次手动点选或输入指令。这要求配置定时触发机制、目标页面识别规则和字段提取逻辑三者协同工作。
确认AionClaw已启用浏览器自动化能力
打开终端,执行openclaw skill list,检查输出中是否包含agent-browser和web-scraper两项。若缺失任一模块,必须先安装:npx clawhub install agent-browser && npx clawhub install web-scraper。
未安装agent-browser会导致所有涉及DOM定位的指令立即失败,且错误提示不明确——它不会报“找不到元素”,而是直接卡在“等待页面加载”状态,超时后返回空结果。
安装完成后执行openclaw gateway restart重启服务,否则新模块不会被加载。
创建自动抓取任务(可视化方式)
启动AionClaw桌面客户端,在左侧导航栏点击「自动化 (RPA)」→「新建网页抓取任务」。
粘贴目标网页URL(如https://example.com/products),勾选「启用列表识别」——这是关键,否则系统只会提取页面首条内容,无法识别商品列表中的多个并列项。
页面加载完成后,用鼠标框选一个完整商品区块(含标题、价格、链接),松开左键 → 点击弹出菜单中的「设为模板」;接着分别悬停在该区块内标题文字、价格数字、跳转链接上,依次点击「标注为【标题】」「标注为【价格】」「标注为【详情链接】」。
标注2–3个同类字段后,系统会自动生成提取规则。此时务必点击右上角「预览提取结果」,检查是否混入了广告位、分页导航或页脚信息。如有,直接在预览窗口中反向点击干扰区域 → 选择「排除此项」,【此操作会永久修改当前任务的清洗规则,不可撤销】。
配置定时执行与导出路径
第一步:设置触发周期
在任务编辑页底部找到「执行计划」区域,点击「添加定时」→ 选择「每天上午9:15」或「每2小时」等固定间隔;也可输入Cron表达式,例如0 15 9 * * *表示每天9:15执行。
第二步:指定导出位置
展开「导出设置」,将「格式」设为CSV,「保存路径」填入绝对路径,例如/Users/yourname/Documents/aionclaw_exports/price_monitor_$(date +%Y%m%d).csv。注意:路径中$(date +%Y%m%d)会被自动替换为当天日期,避免文件覆盖。
第三步:启用异常通知
勾选「执行失败时发送桌面通知」,这样当目标网站改版导致字段定位失效时,你能第一时间收到提醒,而不是等到数据断更三天后才发现。
最后点击「保存并启用任务」,绿色状态灯亮起即表示已激活。
命令行方式快速复用已有任务
方法一:通过任务ID触发单次抓取openclaw automation run --task-id 7a2f9e4b-1c8d-4a2f-b3e1-555a8c7d210f
方法二:查看最近三次执行日志openclaw automation log --task-id 7a2f9e4b-1c8d-4a2f-b3e1-555a8c7d210f --limit 3
任务ID可在客户端任务列表中鼠标悬停于任务名称右侧复制按钮获得,无需进入数据库查询。


















