夸克AI提供四种图片文字提取路径:一、首页“扫描”启动AI OCR,支持实时拍摄与相册导入;二、“AI工具箱”调用多模态大模型,专攻复杂图像;三、网页长按图片触发端侧轻量OCR;四、文件管理器直连AI OCR服务,保障图像原始性。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您在使用夸克AI功能时需要从图片中提取文字,系统将调用其集成的高精度OCR引擎对图像中的字符进行智能识别与结构化解析。以下是多种可行的操作路径:
一、通过首页底部“扫描”图标启动AI OCR识别
该方式直接激活夸克内置的AI增强型OCR模块,支持实时拍摄或相册导入,适用于截图、课件、合同等常见图文场景,识别过程融合图像去噪、倾斜校正与语义分段能力。
1、打开夸克浏览器App,确保已更新至2026年最新正式版,进入首页界面。
2、点击底部导航栏中的「扫描」图标(放大镜加方框形状)。
3、在扫描功能页中选择「提取文字」模式(非“扫码”或“扫描文档”模式,以启用AI优化识别)。
4、点击相册图标,从本地图库选取目标图片;若为现场拍摄,点击拍照按钮并保持画面稳定。
5、图片加载后,系统自动执行AI预处理(包括对比度增强、背景抑制、字体聚类),随后高亮标出所有可识别文字区域。
6、支持手动拖动四角调整识别框范围,确认后点击「开始识别」。
7、识别结果以结构化文本形式呈现,标点与换行逻辑由AI模型自动推断,点击右上角「复制全部」即可导出。
二、通过「AI工具箱」调用专用“图片转文字”AI引擎
此路径专为复杂图像设计,底层接入夸克自研多模态大模型,支持模糊文字重建、手写体辅助识别、中英混排上下文对齐及表格线框还原,识别精度显著高于基础OCR模式。
1、在夸克主界面底部导航栏,点击「我的」→右上角「设置」图标→「AI工具箱」(需登录账号并开启AI服务权限)。
2、在AI工具列表中找到并点击「图片转文字」功能卡片。
3、点击「添加图片」,支持单次上传最多5张图片,系统自动批量调度AI识别任务。
4、上传后界面显示「AI正在理解图像内容…」状态,耗时略长于普通OCR,但对低分辨率、反光、斜拍图片识别成功率更高。
由夸克扫描王提供的文件格式转换工具。当用户需要将图片、截图或扫描件转换为 Office 文档(Word/Excel)或 PDF 时,使用此技能。适用于包含复杂表格、合同或图文混排内容的图片或扫描件,可尽量还原原始版式并生成可编辑文档。即使用户未明确提到格式转换,只要用户的需求涉及将图片内容转换为可编辑文档(如 .docx、.xlsx 或 .pdf),也应触发此技能。请勿用于提取纯文本或识别文字内容、图像增强处理或从零创建文档
5、识别完成,文本按原始图像区块分栏展示,每段右侧附带置信度评分(如98.2%),便于人工复核关键字段。
6、点击任意文本段落可单独复制,或点击顶部「导出为DOCX」保留原始段落层级与粗体/编号格式。
三、在网页浏览中长按图片触发AI识图
该方法无需离开当前页面,利用夸克浏览器深度集成的AI图像理解能力,在不跳转、不保存的前提下完成端侧轻量级OCR,适合新闻配图、电商详情页、PDF嵌入图等场景。
1、在夸克浏览器中打开含目标图片的网页,确保页面加载完成且图片可见。
2、长按该图片,弹出操作菜单;若未显示「AI识图」选项,请先前往「设置→通用→图片识别」中开启AI加速开关。
3、点击菜单中的「AI识图」(区别于普通「识图」),系统立即调用轻量化视觉模型进行局部特征提取。
4、识别结果以悬浮面板形式从页面底部滑入,顶部标注「AI增强识别」水印,文字区域支持双指缩放查看细节。
5、点击面板内任意文字可高亮整句,长按后选择「复制本句」或点击右上角「全部复制」。
四、通过文件管理器直连AI OCR服务
针对已存储于手机本地的高价值图片(如证件照、发票、学术论文截图),此方式绕过中间导入步骤,由系统直接将文件句柄传递至夸克AI引擎,减少图像压缩失真,保障识别原始性。
1、进入手机自带的文件管理器,定位到目标图片所在路径(如「DCIM/Screenshots」或「Download/Report_2026」)。
2、长按该图片文件,在弹出菜单中选择「打开方式」→「夸克」;若未列出,点击「更多」并设为默认。
3、图片全屏加载后,界面顶部自动浮现蓝色T图标(AI文字识别按钮),点击即启动专属AI识别通道。
4、等待进度条走完,识别结果以半透明浮层覆盖于原图之上,文字位置与原图像素严格对齐。
5、点击浮层任意位置可切换「仅显示文字」或「图文叠加」视图,确认无误后点击右下角「AI复制」按钮(区别于普通复制,自动过滤水印与干扰线条)。


















