google 自2023年起弃用meta标签中的noarchive,仅x-robots-tag响应头和search console手动移除有效;静态站点无法使用响应头,需改用410状态码或接受快照存在。

noarchive 写在 <meta name="robots"> 里已经没用了
Google 自 2023 年起正式弃用 noarchive 在 <meta name="robots"> 中的语义,Bing 等主流引擎也同步失效。你在 里写 <meta name="robots" content="noarchive">,爬虫会解析到、但直接忽略——搜索结果里该有快照还是有,Search Console 也不会把它列为已执行策略。
验证方法很简单:右键网页 →「查看网页源代码」→ 搜索 noarchive,如果存在,基本可以删了。
真正能禁快照的只有两种方式
想让页面不生成或保留 Google 快照(Cached 页面),必须绕过已失效的 meta 标签:
-
X-Robots-Tag: noarchive响应头 —— 服务端输出,优先级最高,覆盖所有资源类型(HTML、PDF、JS、CSS) - Google Search Console 中手动提交「移除快照」请求 —— 仅应急,不持久,且要求页面已被索引
注意:noarchive 在 robots.txt、<meta name="Baiduspider"> 或 JS 动态插入中均无效;也不支持组合如 noarchive,nosnippet —— 后者同样被弃用。
静态站点别白写 noarchive 标签
GitHub Pages、Vercel 静态部署、纯 HTML 托管等场景无法注入响应头,<meta name="robots" content="noarchive"> 写了等于白写,还可能误导协作者以为“已设防”。
正确做法是:
- 先查页面是否已被索引:
site:yourdomain.com/your-page或 Search Console 的「URL 检查」工具 - 若未被索引,根本不存在快照,无需任何操作
- 若已被索引,且需长期禁快照,只能换服务端部署或改用
410 Gone状态码(比404更明确,Google 通常数天内清除快照)
别把 noindex 和 noarchive 混用
noindex 是“断根”:页面不进索引库,自然没快照;noarchive(若有效)是“留根去壳”:页面仍可被搜到、有排名,只是不存缓存副本。
常见误判:
- 以为加了
noindex还能保留快照 —— 不可能,快照只属于被索引的页面 - 在 JS 渲染后动态插入
<meta name="robots" content="noarchive">—— 爬虫看不到,快照照常生成 - 页面返回
200但内容为空(如登录页),又只靠noarchive—— 它本就不生效,快照照样存
你要的是“页面可访问、链接可传递权重、但不要快照”,noindex 就错了,得用 X-Robots-Tag: noarchive 响应头 —— 这个点最容易被忽略,也最难补救。
前端入门到VUE实战笔记:立即使用
在学习笔记中,你将探索 前端 的入门与实战技巧!











