无效。follow 单独作为 name="robots" 的 content 值不被主流搜索引擎识别,等同于未声明;应使用标准组合 noindex,follow 来实现“不索引本页但允许追踪其链接”的意图,该组合被 Google、Bing 等明确支持且为推荐做法。

name="robots" 的 follow 值是否有效?
无效。follow 不是 name="robots" 的合法值,主流搜索引擎(Google、Bing、Yandex)均不识别它。设置 <meta name="robots" content="follow"> 等同于没写,爬虫会按默认策略处理——即既抓取当前页,也追踪其链接。
想让爬虫追踪链接但不索引当前页,该用什么?
用 noindex, follow(注意逗号后可加空格,但不能换行)。这是标准组合,明确告诉爬虫:“别收录本页,但可以顺着它里面的 <a> 链接继续爬”。
- Google 自 2019 年起正式支持
noindex, follow,且已将其作为推荐做法替代旧的noindex, nofollow+ 外链导出 - Bing 同样识别该组合,行为一致
- 不要写成
follow, noindex—— 虽然多数解析器能容错,但规范顺序是noindex, follow
只写 follow 会触发哪些意外行为?
实际效果取决于爬虫实现,但常见情况是:忽略整条 meta 指令,退回到默认策略(index, follow)。更糟的是,某些老旧或轻量级爬虫可能因解析失败而跳过整个 meta 标签,导致页面被意外索引。
- Chrome DevTools 的 “Rendering” 面板不会报错,但 Network → Response Headers 或 HTML 源码里能看到该 meta 未被生效
- Google Search Console 的 “URL 检查” 工具会显示 “未指定 robots 指令”,等同于无声明
- 若同时存在
X-Robots-TagHTTP 头,它优先级高于meta,此时follow更无意义
还有哪些常见写法容易被误认为“允许追踪”?
以下写法都不表示“仅追踪链接”,有些甚至起反作用:
立即学习“前端免费学习笔记(深入)”;
-
content="all":非标准值,等效于未声明,不是index, follow的简写 -
content="index, follow":冗余——index和follow都是默认行为,显式写出无害但没必要 -
content="follow":如前所述,非法,会被忽略 -
content=""(空字符串):部分解析器视为空指令,行为不确定,应避免
真正需要控制链接追踪时,只依赖 noindex, follow 或 index, follow 这类明确、标准化的组合。任何省略、颠倒、自造关键词,都会让意图失效——而这种失效往往悄无声息,直到你发现不该被收录的页面出现在搜索结果里。



















