用ChatGPT生成Python脚本驱动本地工具(如tabula-py、python-docx)是批量转换PDF/文本格式的唯一稳定方案,需分步执行指令、校验路径、安装依赖并注意锚定文件避免上下文串扰。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要把几十个PDF表格转成Excel、把一堆txt文本批量套上Word格式、或者让ChatGPT一次性处理整个文件夹里的文档——但又不想一个个上传、复制、粘贴。ChatGPT本身不支持多文件拖拽,也不能直接生成可执行的二进制文件,必须靠指令设计+本地工具链协同才能真正落地批量转换。
用ChatGPT生成Python脚本驱动本地工具
这是目前唯一能稳定批量处理、保留样式、绕过API文件限制的方法。ChatGPT只负责写代码,你负责运行。
第一步:在ChatGPT中输入明确的自然语言指令,例如:“生成一个Python脚本,使用tabula-py库从指定文件夹读取所有PDF文件,提取每页第一个表格,保存为同名Excel文件,路径为D:\pdf_to_excel\output”。
第二步:复制返回的完整代码,在VS Code或PyCharm中新建.py文件并粘贴,检查路径是否与你本地一致——【路径中的双反斜杠\必须保留,单斜杠/会导致Windows报错】。
第三步:在终端执行pip install tabula-py(如未安装Java则先装Java并配置环境变量,否则tabula-py无法启动PDF解析引擎)。
第四步:运行脚本。若提示“JVM not found”,说明Java未正确加入PATH,需重启终端再试。
分次上传+锚定指令模拟批量逻辑
当没有编程环境或只需处理3~5个文件时,可用此法避免写代码,但必须严格控制上下文不串扰。
用于在用户想通过浏览器自动化与 Google Gemini 或 ChatGPT 交互时。触发短语包括“ask Gemini”“ask ChatGPT”“ask GPT”“让...”。
方法一:首次上传第一个PDF后,立刻输入“请仅基于刚刚上传的[report_Q1.pdf]提取全部表格,输出为Excel格式”。等结果返回后再上传第二个文件。
方法二:上传第一个文件后,不急着提问,先发一条锚定指令:“记住:接下来所有问题都只针对[contract_v2.pdf],除非我明确说换文件”。之后再提具体需求,如“把这个PDF第3页的表格转成带表头的CSV”。
注意:ChatGPT会把多次上传的文件混在一起分析,一旦漏掉锚定句,它可能调用错误文件的内容,导致输出完全偏离预期。
绑定外部工具链实现端到端格式封装
ChatGPT不生成.docx或.xlsx二进制文件,但能生成可执行脚本驱动python-docx、openpyxl、pdfplumber等库完成最终封装。该方式保障样式一致性与批量处理能力。
输入指令:“生成Python脚本,用python-docx创建新Word文档,将下列Markdown字符串逐段解析:标题转为Heading 1/2,列表转为Bullet List,代码块设为等宽字体并添加灰色背景”。
拿到代码后,替换其中的Markdown字符串为你的真实内容,确保缩进和空行符合python-docx对段落结构的识别逻辑——【空行缺失会导致所有内容挤进同一个段落,无法分节】。
运行后检查生成的.docx:若标题没变粗、列表没出圆点,大概率是Markdown语法不标准,比如用了-而非*做无序列表,或#后少了空格。














