noarchive 写在 中已失效,google 自2023年起弃用,仅响应头 x-robots-tag: noarchive 或 search console 移除请求有效;静态站点无法设响应头,应直接删除该标签。

noarchive 写在 <meta> 里已经没用了
Google 自 2023 年起正式弃用 noarchive 作为 <meta name="robots"> 的有效指令,Bing 等主流引擎也同步失效。你在 里写 <meta name="robots" content="noarchive">,爬虫会解析到、但直接忽略——搜索结果里该有快照还是有,Search Console 也不会把它列为已执行策略。
真正起作用的只有两种方式:
- 服务端响应头加
X-Robots-Tag: noarchive(推荐,可靠、即时、覆盖所有资源类型) - 在 Google Search Console 中手动提交「移除快照」请求(仅应急,不持久,且需页面已索引)
静态站点(如纯 HTML 托管在 GitHub Pages、Vercel 静态部署)无法注入响应头,noarchive 标签写了等于白写,建议直接删掉,避免误导自己或协作者。
想禁快照,先确认页面是否已被索引
快照是索引的副产品:没被收录,自然没快照;一旦进入索引库,快照才可能生成并更新。所以加任何“禁快照”指令前,必须查清现状:
- 在 Google 搜索
site:yourdomain.com/your-page,看是否出现在结果中 - 进 Google Search Console →「URL 检查」→ 输入目标 URL → 查「索引状态」是否为「已编入索引」
如果显示「未编入索引」,那当前根本不存在快照,也不需要干预;如果已是「已编入索引」,再加 noarchive meta 也没用,必须切到响应头或走移除流程。
noindex 不是禁快照,是断根
noindex 的作用不是“限制快照”,而是让页面彻底退出索引流程。一旦生效,爬虫解析完 HTML 就跳过后续所有步骤——不建索引、不存副本、不生成快照。已有快照会在数小时至数天内下线,但不可恢复。
设计Gmail、Drive、Sheets和Calendar自动化,使用范围感知的计划。用于可重复的每日任务自动化,具备明确的OAuth范围和审计功能。
常见误判点:
- 以为加了
noindex还能保留快照——不可能,快照只属于被索引的页面 - 在 JS 渲染后动态插入
<meta name="robots" content="noindex">——爬虫看不到,快照照常生成 - 页面返回 200 但内容为空(如登录页),又只靠
noindex——爬虫仍会抓取并记录空内容,可能被标为低质
如果你要的是“页面可访问、链接可传递权重、但不要快照”,noindex 就错了,得用 X-Robots-Tag: noarchive 响应头。
服务端怎么加 X-Robots-Tag 响应头
这是目前唯一可靠的快照控制方式,优先级高于所有 HTML meta 标签,且适用于 PDF、JSON、图片等非 HTML 资源。
不同环境配置示例:
- Next.js(App Router):在
layout.tsx或page.tsx的generateStaticParams外层加export const runtime = 'edge',再用headers()函数返回{ 'X-Robots-Tag': 'noarchive' } - Nginx:在 location 块中加
add_header X-Robots-Tag "noarchive"; - Node.js(Express):
res.set('X-Robots-Tag', 'noarchive')放在路由 handler 开头 - PHP:
header('X-Robots-Tag: noarchive');必须在任何输出之前调用
注意:别混用 X-Robots-Tag: noindex, noarchive——noindex 一触发,快照逻辑就终止,noarchive 变成冗余;若只要禁快照,就只写 noarchive。
前端入门到VUE实战笔记:立即使用
在学习笔记中,你将探索 前端 的入门与实战技巧!










