纳米AI支持54种文件格式直传,覆盖文字、表格、演示、音视频、图像及网页链接,无需预处理即可深度解析;文档类自动提取语义并建向量索引,PDF扫描件需OCR识别;.pages和.rtf暂不支持;表格超10万行自动采样前5000行;音视频仅解析音频轨道与关键帧;网页链接、书签及单层压缩包可批量导入。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要把散落在电脑各处的Word报告、会议录音、产品图片、PDF合同、甚至网页收藏夹一次性导入AI系统做统一管理,而不是挨个转换格式再上传。纳米AI支持54种文件格式直传,覆盖文字、表格、演示、音视频、图像及网页链接,无需预处理就能被AI深度解析。
文档类文件上传支持
直接拖入或点击上传.doc、.docx、.pdf、.txt、.epub、.md等纯文本或排版型文档,系统会自动提取语义并建立向量索引。其中PDF若含扫描件图像,需依赖OCR模块识别;若为可选中文本,解析速度更快且保留原始段落结构。
注意:.pages(苹果页式文档)和.rtf暂不支持,上传后会提示“格式未识别”,请先导出为.docx再传。
播客文章生成器。将音频文字稿、节目链接、摘要笔记转化为结构清晰、适合发布的图文文章。支持多种输出风格(深度解析、精华摘要、对话体重构、社交媒体切片)和多种输出格式(Markdown、微信公众号、知乎、企业内刊)。触发词:播客文章、播客转文章、podcast to article、podcast article
表格与演示文件
方法一:Excel类文件
支持.xlsx、.xls、.csv、.ods,上传后AI可识别行列关系、公式逻辑与单元格注释,生成结构化问答结果。表格超过10万行时,系统将自动采样前5000行建模,避免内存溢出。
方法二:PPT类文件
支持.pptx、.ppt、.key(Keynote),AI不仅能提取每页文字,还能分析图表类型(柱状图/流程图/甘特图)、识别图例含义,并还原原始配色逻辑——这一步对后续生成风格一致的汇报PPT至关重要。
音视频与图像文件
① 音频文件:仅支持.mp3、.m4a、.wav、.ogg,单文件≤200MB;上传后触发语音转写+发言人分离模型,前提是已录入参会人声纹或姓名列表。
② 视频文件:支持.mp4、.mov、.avi、.webm,但【仅解析音频轨道与关键帧画面】,不执行全帧AI渲染;若需提取字幕或时间轴,必须勾选“启用语音转录”选项。
③ 图像文件:支持.png、.jpg、.jpeg、.webp、.bmp、.tiff、.svg,其中SVG矢量图可被反向解析为路径指令,用于生成技术示意图;含二维码或条形码的图片,AI会自动识别并提取编码内容。
网页与特殊格式
第一步:粘贴网址
在知识库“添加内容”面板中选择“网页链接”,粘贴https://开头的URL,支持知乎专栏、微信公众号文章、Notion公开页、PDF在线地址等主流页面类型。
第二步:导入浏览器书签
点击“导入收藏夹”,选择Chrome/Firefox/Edge导出的.html书签文件,纳米AI会批量抓取所有链接的标题与首屏文本,生成带来源标注的知识节点。
第三步:上传压缩包
支持.zip、.7z、.rar(需内含上述任一受支持格式),系统自动解压并逐个解析——但【不支持嵌套多层压缩包】,如archive.zip内再含sub.zip,第二层将被跳过。













