301重定向设置完成后,访问、抓取、索引是三个不同阶段的结果。访问是用户或工具请求URL时得到的状态;抓取是搜索引擎爬虫按自身调度请求URL;索引是搜索引擎把页面内容纳入可检索库。要区分它们,核心是分别查看“请求响应”“爬虫日志”“索引状态”三类证据,不能只凭浏览器能打开就判断已索引。
假设你把 https://example.com/old-page 通过301重定向设置指向 https://example.com/new-page。用户浏览器访问旧地址,看到跳到新页,这只证明访问层面重定向生效。搜索引擎爬虫是否来抓旧地址、是否跟随到新地址、新地址是否进入索引,需要另查。
常见错误是:只测了浏览器跳转,就认为旧页面已替换、新页面已收录。实际上可能出现:访问正常跳转,但爬虫尚未抓取旧地址;或爬虫抓取了旧地址并跟随,但新地址因内容质量、重复、robots.txt限制等原因未进入索引;也可能旧地址仍暂时出现在索引结果中,因为索引更新滞后于抓取。
访问层面的检查项:
Location应指向目标URL,且目标URL可正常返回200。判断结果:如果状态码不是301,或Location指向错误,问题在重定向配置,不在索引。如果状态码正确、目标页可访问,访问层面可判为通过,但仍不能推断已抓取或已索引。
抓取层面的证据主要来自服务器日志或搜索引擎提供的抓取统计。检查项:
可能原因包括:旧URL本身很少被链接、站点地图仍列旧URL、robots.txt禁止抓取目标路径、服务器对爬虫返回错误。这里要区分“可能原因”与“已经定位的原因”:日志没有爬虫记录,可能是从未抓取,也可能是日志未保留、爬虫被CDN拦截或使用了不同User-Agent,需逐项排除。
索引层面的检查不能靠访问跳转判断。可用站点查询指令或搜索控制台类工具查看目标URL是否被索引,但不同搜索引擎支持情况须分别核查。检查项:
注意:robots.txt的抓取限制不等于可靠的索引移除。禁止抓取只阻止爬虫访问,已索引的URL仍可能因外部链接等原因出现在结果中。站点地图也不保证收录,它只是发现URL的辅助手段。HTTPS不保证安全无漏洞或排名,它只是传输层加密。
可执行步骤:
适用条件:这套流程适用于页面迁移、域名更换、URL结构调整后的301重定向设置核查。判断结果时,访问正常只说明配置层通过;抓取正常说明爬虫已跟进;索引正常才说明目标页可被检索。三者缺一,就不能说301重定向设置已经完成全部目标。
下一步:先记录旧URL的301响应和目标URL的200响应,再对照日志与索引状态,定位卡在访问、抓取还是索引阶段。