需打通浏览器扩展、本地服务、权限配置与工具链调用四环节:先安装启用Hermes扩展并确认图标激活;再运行hermes start绑定端口,于扩展选项中填入后端地址并保存;接着在chrome://extensions/中为目标网站授予权限并勾选数据访问提示;最后执行browser_navigate→browser_snapshot→browser_type→browser_press闭环操作,并用web-scrape技能提取带语义标签的结构化JSON。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你想让Hermes Agent自动打开网页、点击按钮、填写表单并提取结构化数据,而不是手动复制粘贴或写Python爬虫脚本。这需要打通浏览器扩展、本地服务、权限配置与工具链调用四个关键环节,缺一不可。
安装并启用Hermes浏览器扩展
浏览器扩展是所有自动化操作的入口,没有它,后续指令无法注入页面上下文。
访问 Chrome Web Store 或 Hermes 官方发布页,下载最新版 【.crx 文件】;在 chrome://extensions/ 页面开启“开发者模式”,将 .crx 文件直接拖入页面完成安装。
安装后检查工具栏右上角是否出现 Hermes 图标,点击图标确认状态为“已启用”——若显示灰色或无响应,说明扩展未激活,所有 browser_* 指令都会静默失败。
配置本地服务与端口绑定
扩展必须连接到正在运行的 Hermes 后端服务,否则就像电话拨通却没人接线。
第一步:在终端执行 hermes start,等待输出中出现 Listening on http://127.0.0.1:8080 ——这是默认监听地址,【端口号必须与扩展设置完全一致】。
第二步:进入 chrome://extensions/ → 点击 Hermes 扩展右侧“详情” → 滚动到底部点击“扩展选项” → 在“后端地址”栏填入 http://127.0.0.1:8080 → 点击“保存配置”。
第三步:看到绿色“连接成功”提示条后,关闭并重新打开一个新标签页,强制刷新扩展上下文。
授予目标网站访问权限
浏览器会拦截未经许可的 DOM 读写请求,这是安全机制,不是 bug。
方法一:在 chrome://extensions/ 的 Hermes 扩展详情页中,“站点访问权限”选“在所有网站上启用”。
方法二(推荐):点击“在以下网址上启用”,手动添加具体域名,例如 https://example.com、https://news.example.com ——只给必要站点授权,避免扩展在银行、邮箱等敏感页面意外触发。
【注意】弹窗提示“允许此扩展读取和更改您在所访问网站上的数据”必须勾选,否则 snapshot 返回为空,@eN 引用全部失效。
执行四步闭环式网页操作
拟人化操作必须遵循“快照→定位→动作→再快照”循环,跳过任何一步都可能导致引用错位或操作丢失。
① 运行 browser_navigate https://news.example.com 加载页面。
② 立即执行 browser_snapshot full=false,获取当前可访问性树,返回类似 @e3: 搜索框, @e7: 登录按钮 的映射列表。
③ 调用 browser_type "@e3" "AI 自动化教程" 向搜索框输入文字——这里必须用双引号包裹 ref ID 和文本,否则解析器会把空格当作分隔符。
④ 执行 browser_press "@e3" Enter 提交搜索,随后再次 browser_snapshot full=false 获取新页面元素,为下一步点击标题做准备。
提取结构化网页内容
单纯截图或复制 HTML 不够,你需要语义清晰、字段明确的 JSON 输出。
启动 Hermes 终端后,先运行 /skills 确认 web-scrape 已启用;若未列出,执行 hermes skill install web-scrape 安装。
发送自然语言指令:“请访问 https://example.com/article/123 ,提取主标题、导语、正文段落、所有
- 列表项及作者信息,返回带 type 字段的结构化 JSON”。
返回结果中每个文本块都附带 "type": "heading1"、"type": "paragraph" 等语义标签,且保留原始嵌套层级——若某字段为空或仅含 script 标签,说明 Camofox 代理未启用或页面 JS 渲染未完成。


















