<meta name="robots" content="noarchive">基本无效——Google自2017年起完全忽略,Bing自2022年后停止支持;真正生效的只有HTTP响应头X-Robots-Tag: noarchive或robots.txt路径屏蔽。

noarchive meta 标签是否还有效
基本无效。Google 自 2017 年起已完全忽略 <meta name="robots" content="noarchive">,Bing 也在 2022 年后停止支持。现在设置它不会阻止搜索引擎生成或展示快照。
替代方案:用 robots.txt 还是 HTTP 头
真正起效的只有两种方式,且适用场景不同:
- 若想全局禁止某页面被缓存(包括快照、网页快照链接、“Cached”按钮),必须通过响应头:
X-Robots-Tag: noarchive - 若只是禁止爬虫抓取该页面(连带也就没快照),可用
robots.txt屏蔽路径,但注意这不等于禁止快照——已有快照仍可能保留并展示 -
<meta name="robots" content="noarchive">已无实际作用,别再写进模板里浪费字节
HTTP 响应头怎么加(Nginx / Apache / Node.js)
必须确保该 header 出现在 HTML 响应中,且不能被 CDN 或反向代理意外删掉:
- Nginx:在 location 块中加
add_header X-Robots-Tag "noarchive"; - Apache:用
Header set X-Robots-Tag "noarchive"(需启用 headers_module) - Node.js(Express):
res.set('X-Robots-Tag', 'noarchive');,注意要放在res.send()之前 - 验证方式:打开 Chrome DevTools → Network → 点开 HTML 请求 → 查看 Response Headers 是否含
X-Robots-Tag: noarchive
为什么 meta noarchive 容易被误信
老文档、SEO 博客、甚至部分 CMS 插件仍在推荐它,是因为:
立即学习“前端免费学习笔记(深入)”;
- 早期 Google 确实支持过该 meta(2007–2017),但早已移除逻辑
- 部分爬虫(如某些小众采集器)可能仍解析它,但这不是标准行为,不可依赖
- 它和
noindex混在一起写,让人误以为“都写上更保险”,实际noindex有效,noarchive不再有效
真正要屏蔽快照,只认 X-Robots-Tag 响应头;漏掉这个,其他任何地方加都没用。



















