需启用ocr-and-documents技能、规范PDF路径与命名、执行hermes index --force重建索引、确保MEMORY.md注入元信息,并可用WebUI上传验证;任一环节缺失均导致PDF无法识别。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您已将PDF文档存入本地知识库目录,但Hermes Agent无法识别或检索其中内容,则可能是由于文档未被正确解析、OCR技能未启用、索引未重建或元信息未注入MEMORY.md。以下是解决此问题的步骤:
一、启用并配置ocr-and-documents技能
该技能是读取本地PDF文档的前提条件,负责从扫描件、图像型或加密受限PDF中提取可检索的纯文本与结构化语义,Hermes Agent默认不自动加载此技能,需手动启用。
1、运行命令hermes skills list查看当前已加载技能列表,确认ocr-and-documents是否在其中。
2、若未启用,执行命令hermes skills install ocr-and-documents安装该技能。
3、执行命令hermes skills load ocr-and-documents将技能加载至当前会话环境。
二、检查PDF文件存放路径与命名规范
Hermes Agent的检索层仅扫描预设知识库目录下的文件,且对路径层级、扩展名及文件名字符敏感;路径错误、命名含中文标点或空格会导致文件被跳过解析,无法进入OCR流程。
1、确认PDF文件位于knowledge-base/目录或其直接子目录(如knowledge-base/01_政策/)内,不可置于~/Downloads等非知识库路径。
2、确保文件名不含中文、空格、前导点号或特殊符号,推荐使用英文小写字母、数字与下划线组合,例如ai_governance_whitepaper_v3.pdf。
3、验证文件权限:在Linux/WSL2环境下,运行ls -l knowledge-base/**/*.pdf,确认当前用户具有read权限(显示-rw-r--r--或类似)。
三、触发手动索引重建
即使PDF已就位且技能已启用,Hermes Agent也不会实时监听文件系统变更;必须显式调用索引命令,强制OCR引擎重新处理全部PDF并写入全文索引。
1、进入知识库根目录:cd ~/knowledge-base。
2、运行索引命令:hermes index --force,该操作将遍历所有PDF,调用OCR-and-documents技能逐页识别与分块。
3、观察终端输出,确认出现类似[INFO] Extracted 892 tokens from /01_政策/data_privacy_regulation.pdf的日志行,表明OCR与文本提取成功。
四、验证MEMORY.md中是否注入PDF元信息
成功索引后,Hermes Agent会将PDF标题、关键段落摘要、章节锚点及绝对路径写入MEMORY.md,作为自然语言问答时的上下文依据;若该文件未更新,则检索层无法建立文档关联。
1、打开~/knowledge-base/MEMORY.md,搜索PDF文件名或文档中高频关键词(如“个人信息”、“跨境传输”)。
2、若未找到对应条目,检查~/.hermes/skills/ocr-and-documents/config.yaml中inject_to_memory字段是否设为true。
3、若配置正确但仍未注入,手动执行hermes doc inject --file knowledge-base/01_政策/data_privacy_regulation.pdf强制注入元信息。
五、使用WebUI上传并即时问答验证
该方法绕过知识库索引链路,通过前端直传方式触发OCR解析与临时内存加载,适用于快速验证单个PDF是否可被识别,不依赖本地索引状态。
1、打开Hermes Agent WebUI界面,在文档区域拖入PDF文件(支持单次多文件)。
2、等待右上角状态栏显示“Processing complete — 1 document indexed”,表示OCR与结构分析完成。
3、在聊天框输入自然语言问题,例如“这份文件中关于儿童信息处理的要求有哪些?”,观察是否返回精准定位的原文段落与页码。



















