必须对五类材料分别满足硬性门槛:PDF需OCR为文字型;TXT须结构化标记且≤200MB;截图需含清晰文字;网页链接须免登录且非JS渲染;Google Docs/Slides需设公开权限并禁用组织限制。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要把PDF合同、会议录音转写的TXT、竞品官网截图、Google Docs调研提纲和网页链接全部塞进同一个笔记本,让AI基于这五类材料交叉推理——但上传前必须清楚每种格式的硬性门槛,否则资料会“隐身”,AI永远读不到。
PDF文件:文字型是底线,扫描图必须先OCR
打开PDF,用鼠标尝试选中任意一段正文文字。能高亮、能复制、粘贴后不乱码(如“智能体”不变成“能体”),才是合格的文字型PDF。如果复制出来全是方框或符号,说明它是扫描图/PNG截图合成的PDF,【必须用WPS或Adobe Acrobat执行OCR识别,且语言选“中文(简体)”,否则AI解析时会漏掉70%以上关键条款】。实测显示,未OCR的15页合同PDF上传后,AI仅能提取出3处页眉和2个标题,正文内容全为空白。
音频与文本文件:录音要先转写,TXT需带明确结构
Gemini Notebook不直接处理MP3/WAV等音频文件。你必须先用讯飞听见、腾讯云ASR或Mac自带语音备忘录将会议录音转为TXT。转写后的TXT不能是纯时间戳堆砌(如“00:01:23 张总:……”),要在关键决策点手动插入分段标记,例如“【待办事项】”“【争议点】”“【数据结论】”。【没有结构标记的TXT会被AI当作连续散文处理,无法定位“张总说下周三前确认预算”这类具体指令】。纯文本文件大小不能超过200MB,超限会触发上传失败提示。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
图片与网页链接:截图要带文字区域,链接必须可公开访问
上传PNG/JPEG截图时,确保画面中至少包含一行可读文字(如Excel表格表头、PPT标题栏、网页URL地址栏),且文字清晰无反光、无马赛克。纯产品外观图、流程图箭头、无标签的饼图,AI无法提取有效语义。网页链接必须满足两个条件:一是该页面无需登录即可打开;二是内容不含JavaScript动态渲染的主信息(如某些财报页面的数据表格实际由JS加载,NotebookLM抓取到的只是空div)。遇到后者,直接保存网页为MHTML或PDF再上传更可靠。
Google Docs与Slides:权限设置决定AI能否读取
第一步:在Google Docs中点击右上角“共享”→“获取链接”→将权限设为“任何人拥有链接可查看”。第二步:复制该链接,粘贴到Notebook的“Sources”→“+”→“Web link”栏。如果文档仍显示“无法加载”,检查原始Docs是否启用了“限制对组织外人员的访问”——【只要Google Workspace管理员开启此策略,即使链接设为公开,NotebookLM也完全无法抓取内容】。Slides同理,但需额外注意:动画页、隐藏幻灯片、嵌入视频的字幕轨道均不会被解析。
批量上传操作路径与容错阈值
① 进入笔记本 → 左侧边栏点击「Sources」→ 点击「+」→ 选择「Upload」;② 将所有待传文件(PDF/TXT/PNG/DOCX等)一次性拖入弹窗区域;③ 等待状态条变绿,绿色进度条走完即完成上传;④ 【单次最多拖入20个文件,总大小不超过200MB;超出则系统静默丢弃后排文件,不报错也不提示】;⑤ 上传完成后,立即点击右上角“刷新资料”按钮——这一步跳过,所有文件在AI眼里仍是空白。















