浏览器原生“另存为文本”最省事,适合文字可选网页;若禁选则用Ctrl+U查源码或javascript:document.body.innerText提取纯文本;批量处理可用WPS网页采集助手。

想把网页上一篇几千字的行业分析或政策原文,不带广告、导航栏和乱码格式,直接变成干净可读的.txt文件,用系统自带功能就能一步到位,不需要装插件或登录账号。
浏览器原生“另存为文本”功能
这方法最省事,适合文字可选、无反复制限制的网页,比如政府官网、新闻门户、技术博客。
第一步:在目标网页上用鼠标拖选全部需要保存的文字内容→右键点击选区→选择【保存为文本】(部分浏览器显示为“将所选内容另存为…”)。
第二步:在弹出的保存窗口中,将“保存类型”下拉菜单改为「文本文档(*.txt)」→修改文件名→选择保存位置(如桌面)→点击「保存」。
注意:如果右键菜单里没有“保存为文本”,说明当前网页启用了JavaScript禁选机制,需跳转到下一方法。
强制提取纯文本(绕过复制限制)
遇到文字无法选中、右键被禁用、或页面加载大量动态脚本时,必须剥离HTML结构,只取原始字符流。
方法一:Ctrl+U查看源代码→Ctrl+A全选→Ctrl+C复制→新建记事本→Ctrl+V粘贴→Ctrl+H打开替换窗口→查找“<[^>]*>”(勾选“使用通配符”)→替换为空→重复执行直到无匹配→删除首尾大量空行和乱码段落→保存为UTF-8编码的.txt文件。
方法二:在浏览器地址栏前缀输入 【javascript:document.body.innerText;void(0)】 →回车→页面自动清空为纯文本→Ctrl+A全选→Ctrl+C复制→粘贴进记事本→保存。
这一步操作起来很简单,直接把复制的内容粘贴进记事本就行。但要注意:用innerText提取的内容会丢失换行逻辑,段落可能挤成一行,需手动按句号/分号后回车分段。
批量保存多个网页正文为统一TXT
当你需要把一整套教程、系列文章或招标文件的每一页都转成独立txt,并保持标题清晰、顺序正确时,单页操作太耗时。
① 打开WPS文字→点击左上角「开始」选项卡→找到「网页采集助手」插件(若未启用,在「插件中心」搜索安装);
② 点击插件图标→在弹窗中粘贴第一个网页URL→勾选「仅提取正文」+「自动添加标题」;
③ 点击「添加网址」继续输入其余链接,最多支持20个;
④ 全部填完后点「开始采集」→等待AI识别完成→右侧预览区确认无误→点击「导出为TXT」→选择「每页单独文件」或「合并为单个文件」→指定文件夹→完成。
导出前务必检查标题是否准确提取,【若网页标题含特殊符号(如/、|、*),WPS会自动过滤,导致文件名截断】,建议提前手动修改URL中易出错的部分。

















