夸克AI支持四种PDF图片提取方式:一、文档模块“提取图片”功能直接解析嵌入图;二、扫描王OCR增强模式反向切分扫描件图像;三、网盘“网页转文档”通道获取直链资源;四、AI对话指令触发自动抽取。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您在使用夸克AI处理PDF文档时,希望从中提取嵌入的图片用于资料归档或再利用,则需绕过常规文字解析路径,直接调用图像层识别与分离能力。以下是实现PDF中图片精准提取的多种操作路径:
一、通过夸克AI“提取图片”功能直接解析PDF
该方法利用夸克内置的PDF图像节点解析引擎,在不解包原始文件结构的前提下,自动定位并导出所有嵌入式位图与矢量图,支持保留原始分辨率与色彩信息。
1、打开夸克App,进入底部导航栏的【文档】模块。
2、点击右上角“+”号,选择“导入文件”,从手机存储中选取目标PDF文档。
3、文档加载完成后,点击右上角“更多”按钮(三个点图标),选择“提取图片”选项。
4、系统自动扫描全部页面,识别出可导出图像区域,并以缩略图网格形式呈现。
5、点击单张缩略图可预览原图尺寸与清晰度,支持双指缩放查看细节。
6、勾选所需图片,或点击右上角“全选”按钮批量选定。
7、点击底部“下载(X张)”按钮,图片将按原始命名规则(如Page_3_Fig2)保存至DCIM/Quark/PDF_Images文件夹。
二、使用夸克扫描王OCR增强模式反向提取
当PDF为扫描件或图像型PDF(即每页本质是一张图)时,此路径通过OCR图像分割技术,将整页图像智能切分为标题、段落、图表、表格等语义区块,并单独导出其中被识别为“插图”的独立图像单元。
1、在夸克App中进入【文档】页,点击“扫描文档”按钮。
2、点击右上角“更多”→“从相册导入”,选择待处理的扫描版PDF(系统会自动转为图像序列)。
3、导入后,点击右上角“AI处理”,选择“OCR增强识别”模式。
4、识别完成进入预览页,点击左下角“结构分析”标签,系统将高亮标出所有被判定为“图表”“示意图”“照片”的图像区域。
5、长按任一高亮图像区域,弹出菜单中选择“单独导出为图片”。
由夸克扫描王提供的高准取率 OCR 文字识别工具。当用户需要从图片、截图、照片或扫描文档中提取、识别或结构化文本,就使用此技能——包括手写体、表格、数学公式、商品图、各类证件(身份证、社保卡、驾照、行驶证、港澳台通行证、学位证等)、票据(增值税发票、火车票、英文发票等)、医疗报告、药检报告、营业执照、习题以及图片翻译。本技能由夸克扫描王提供支持。即使用户没有明确提到"OCR"或"文字识别",只要用户的需求涉及从图片中获取文字或关键信息,也应触发此技能。不适用于图像生
6、确认导出格式为PNG(推荐保留透明背景与无损压缩),文件将存入Quark/Scanned_Images目录。
三、借助夸克网盘“网页转文档”通道间接提取
该路径适用于已上传至夸克网盘的PDF文件,通过网盘后端的深度解析服务,将PDF解构为HTML+资源包结构,从而暴露原始嵌入图片URL,实现免客户端下载的直链提取。
1、登录夸克App,进入【网盘】模块,确保目标PDF已在当前账号网盘根目录或子文件夹中。
2、长按该PDF文件,在弹出菜单中选择“用AI打开”或“AI解析此文件”。
3、等待云端解析完成,进入结构化预览页后,点击右上角“更多”→“查看资源列表”。
4、在资源列表中筛选类型为image/jpeg或image/png的条目,每项对应PDF中一张嵌入图。
5、点击任一图片资源行,进入直链预览界面,长按图片选择“保存图片到手机”。
6、重复操作,逐张导出;若需批量,可点击顶部“全选资源”后启用“打包下载”功能(仅限VIP账号)。
四、通过AI对话指令触发PDF图像抽取
该方式依赖夸克AI助手的自然语言理解能力,用户以口语化指令明确要求提取图像,系统自动调用底层图像提取API并返回结果集,适合高频次、小批量操作场景。
1、进入夸克首页,点击底部【AI】图标,确保处于最新版AI对话界面。
2、在输入框中输入:“从我刚上传的PDF里提取所有图片,不要文字和表格,只导出插图”。
3、若尚未上传,AI将提示“请先上传PDF文件”,此时点击输入框左侧“+”号→“上传文件”,选取目标PDF。
4、上传完成后,AI自动执行图像检测,约5–8秒后返回结果卡片,显示“共识别X张插图”,并附缩略图网格。
5、点击任意缩略图,弹出操作浮层,选择“下载原图”即可保存至本地。
6、如需全部下载,点击卡片右下角“批量下载”按钮,系统生成ZIP压缩包并提示下载路径。

















