DuMate可从本地文件夹中自动提取合同金额、甲方名称等关键字段,支持PDF/Word/Excel/扫描件;授权工作区后启用文档解析技能,通过预置模板或手动标注自定义字段,批量解析并高亮定位原文。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

用DuMate从项目文档中精准提取关键字段,比如合同金额、甲方名称、签约日期、付款周期这些信息,不用手动翻页复制粘贴,也不用写正则或调API——它能直接读懂你本地文件夹里的PDF、Word、扫描件甚至带表格的Excel。
第一步:授权工作区并上传文档
打开DuMate客户端,点击「设置工作区」→ 选择你存放项目文档的文件夹(如「D:\项目资料\2026Q2合同」),勾选「允许访问子文件夹」。【必须开启此选项,否则无法读取嵌套层级中的文件】
确认授权后,DuMate会自动扫描该路径下所有支持格式的文档(.pdf/.docx/.xlsx/.jpg/.png),无需逐个上传。
第二步:启用文档解析技能并配置字段模板
进入「技能中心」→ 找到「文档解析」→ 点击「启用」。系统默认加载通用字段识别模型,但项目文档有强业务属性,需定制化适配。
方法一:使用预置模板
点击「新建提取任务」→ 在模板库中选择「商务合同」或「项目立项书」→ 系统自动映射常见字段(甲方/乙方/总金额/起止时间/违约责任)→ 直接运行。
方法二:手动定义字段
点击「自定义字段」→ 输入字段名(如“验收标准”、“履约保证金比例”)→ 设置类型(文本/数字/日期)→ 对每项点击「示例标注」,在预览窗口中用鼠标框选1~2份文档里的真实位置 → 模型立刻学习该字段的视觉与语义特征。
注意:同一字段在不同文档中排版差异大时(比如有的写“甲方:XXX公司”,有的写“采购方:XXX公司”),务必至少标注3种变体,否则漏识别率会上升。
第三步:批量执行提取并校验结果
第一步:在任务列表中勾选要处理的全部文档
第二步:点击「开始提取」→ DuMate启动多线程解析,对PDF走OCR+语义理解双路识别,对Word/XLSX直接结构化解析
第三步:5秒内生成结构化结果页,字段值按列对齐,右侧显示原始出处高亮定位
提取完成后,点击任意字段值右侧的「定位原文」图标,DuMate会自动跳转到对应文档的精确页码与坐标区域,方便人工复核。发现错标时,直接在结果页修改→点击「反馈修正」,模型下次同类文档识别准确率会提升。


















