千问AI可快速识别截图文字并输出可编辑文本:网页端通过“图片转Word”入口支持大图、表格及中英文混排;手机App提供离线OCR和聊天传图识字;结构化需求需明确指令导出Excel。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要快速从手机截图或电脑截屏里提取文字,比如会议记录、聊天截图、产品参数表,又不想手动敲字——千问AI能直接识别图中文字并输出可编辑文本,整个过程不到30秒。
网页端上传截图识别
这是最稳定、支持最大图片尺寸的方式,适合处理带表格、多段落或中英文混排的截图。
第一步:打开浏览器,访问 https://www.php.cn/link/cd726e6cc24cd0afe34ca7572891678e,登录你的阿里云账号。
第二步:点击顶部导航栏【效率】→【格式转换】→【图片转Word】(该入口实际调用的是qwen-vl-ocr模型,专为文字识别优化)。
第三步:在上传区域拖入你的截图文件(支持JPG、PNG,单张不超过10MB;若截图含关键表格,建议优先选PNG格式,避免JPEG压缩导致细线断裂)。
第四步:等待几秒识别完成,页面自动显示还原排版后的文本——标题加粗、段落缩进、列表符号都会保留。点击【复制全文】即可粘贴到Word或微信,【无需手动校对标点与换行,系统已按原文语义自动分段】。
手机App内直接识图
适合通勤途中、会议间隙快速抓取一张图里的核心信息,全程离线也能运行基础OCR。
使用AIsa生成图像与视频。仅需一个API密钥即可调用Gemini 3 Pro Image(图像)和Qwen Wan 2.6(视频)。
方法一:用通义App“AI识图”功能
打开最新版通义App → 底部导航栏点“AI识图” → 右上角“+” → 选择相册中截图 → 加载完成后点击底部“识别文字”按钮 → 结果以可编辑文本形式浮现在屏幕下方,支持长按复制整段。
方法二:在聊天输入框直接传图提问
进入任意对话页 → 点击输入框旁的“?”图标 → 选择截图 → 发送后立刻输入:“请提取图中全部文字,按原文分行输出,不要改写或删减” → AI会在5秒内返回纯文本结果,【注意:此方式默认不启用手写增强,若截图含潦草笔记,需额外加指令“重点识别手写部分”】。
截图转Excel结构化导出
当你截的是带编号的清单、报价单、检查表,需要直接变成Excel可用的行列数据时,别只提“识别文字”,要明确告诉AI你要什么结构。
在网页端或App上传截图后,输入指令:“识别图中所有带数字编号的条目,每条占一行,提取‘编号’‘项目名称’‘状态’三列内容;若某行含‘✓’‘●’等标记,填入‘状态’列;无状态说明则留空。”
AI会返回TSV格式表格,点击【导出为Excel】按钮,下载的.xlsx文件已自动匹配列宽、冻结首行,双击单元格即可修改。

















