纳米AI支持54种格式文件上传与智能分析,需更新至V1.3.14及以上版本,上传后必须手动选择对应MCP工具(如知识卡片生成、OCR或语音转写)并触发分析,才能确保页码标签、时间戳、口语化摘要等关键信息准确生成。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要把PDF讲义、会议录音、PPT课件或手机拍的笔记照片导入纳米AI,并让它自动识别文字、提取重点、打上标签、生成知识卡片或图表——整个过程必须从上传那一刻起就可控、可追溯、不丢信息。
确认上传前提与格式兼容性
打开纳米AI网页版或电脑客户端(V1.3.14及以上),登录后先别急着点【+】。【若使用旧版本,上传后可能卡在“解析中”且无报错提示,必须更新】。
纳米AI支持54种格式,但并非所有都走同一条处理链:文字型PDF、.docx、.txt可直接语义切分;扫描PDF、JPG/PNG需OCR;MP3/M4A音频走语音转写;PPT和Excel会分别解析幻灯片逻辑与表格结构。
测试文件是否为可识别文本:在本地用PDF阅读器按Ctrl+A,能全选文字→可直传;若仅框选乱码或无反应→是扫描件,需先用系统自带“图片转文字”工具预处理,再上传TXT。
上传文件的三种操作路径
方法一:拖拽即传(推荐新手)
在首页或任意知识库内,找到灰色虚线框上传区→将1~5个文件同时拖入→松手即开始上传→进度条显示“上传中…92%”时不要刷新页面,否则中断且不恢复。
方法二:点击按钮选择文件
点击【上传文件】→弹出系统选择窗口→可多选(按住Ctrl键勾选多个)→选中后点击「打开」→等待右上角出现绿色对勾图标,表示已入队列。
方法三:从知识库内定向添加
进入已有知识库→点击顶部“添加内容”→下拉菜单中选择“从网页链接导入”“从微信聊天记录同步”或“拍摄新图片”→后者会调起摄像头,拍完自动触发OCR,适合现场速记场景。
纳米AI是一款基于人工智能大模型技术开发的智能应用工具,主要用于提供AI问答、内容生成、信息整理与智能搜索辅助等功能。用户可通过自然语言交互方式获取结构化信息与文本内容,用于学习、办公及内容创作等多种场景。
上传后必须做的关键一步:触发分析
第一步:等待右上角通知栏弹出“✅ 文件已上传,共3份”提示,此时文件仅存于临时缓存,尚未被解析。
第二步:立即点击右侧“分析”图标(齿轮形状)→若没看到该图标,请先确认是否已进入具体知识库页面,首页不显示此按钮。
第三步:在弹出面板中【必须手动选择“知识卡片生成”“文档解析”或“语音转写”等MCP工具,不能点默认的“文档总结”】——选错会导致后续无法提取公式、页码标签或时间戳对齐。
第四步:点击“开始分析”→界面跳转至任务日志页,实时显示:“正在OCR识别第2页→提取定义句→聚类对比项→生成语义向量”。普通PDF约耗时8~15秒,含图表的PPT或60分钟录音需40秒以上。
验证分析结果是否可用
分析完成后,系统自动跳转至内容预览页。检查三项硬指标:
• 每张卡片顶部是否带准确页码标签(如P17);
• 音频转写稿是否按12秒切片并标注时间戳(02:15–02:27);
• PPT缩略图下方是否嵌有口语化摘要(如“第5页:解释‘电压暂降’时提到UPS切换延迟案例”)。
若任意一项缺失,说明MCP工具未正确启用,需返回上一步重新选择并触发分析。
此时可直接截图保存单张卡片,或点击右上角“导出为PNG”批量下载全部可视化结果。

















