区分抓取、索引和排名,关键是看页面在搜索链路中走到了哪一步:抓取是搜索引擎发现并读取URL;索引是读取后把内容存入可供检索的库;排名是用户搜索时,系统从索引中选出并排序展示。三者是先后环节,不是同一件事。页面没排名,可能是没被抓取,也可能是被抓取但未索引,还可能是已索引但竞争不过其他页面。
不要一看到流量下降就认定“被降权”。先建立一张最小排查表,把问题拆成三层:
准备阶段只需要三类证据:URL本身、查询词、以及能反映抓取与索引状态的公开工具数据。没有证据时,先不要改标题、堆内容或删页面。
最实用的一步是:在搜索引擎的站点管理工具中,对具体URL发起“检查URL”或等效的抓取测试,查看它显示的是“已抓取”“已编入索引”“已发现但未抓取”还是“已抓取但未索引”。不同搜索引擎的界面名称不同,但判断逻辑一致。
如果工具不可用,可以用更基础的观察法:
site:你的域名/具体路径,看该URL是否出现。出现只说明它可能已进入索引,不等于某个目标词有排名。noindex、robots.txt、规范标签等线索核对:noindex会阻止索引,robots.txt可能阻止抓取,规范标签可能把索引信号指向别的URL。这里要区分“可能原因”和“已经定位的原因”。例如,日志里没有爬虫记录,可能是从未被抓取,也可能是爬虫用了其他标识、日志被截断或访问被防火墙拦截。只有结合工具状态和服务器响应,才能把猜测变成结论。
验证时不要只盯一个词。选三类查询做对照:
判断结果可以这样归类:工具显示“已发现但未抓取”,先查内链、站点地图和服务器可访问性;显示“已抓取但未索引”,先查内容是否单薄、重复、与用户查询不匹配;显示“已索引但无排名”,再进入标题、内容深度、外部信号和搜索意图匹配的优化。
维护阶段建议按周或按版本记录,而不是只看总流量:抓取层记录抓取请求数、错误响应、被robots阻止的URL;索引层记录已索引URL数、被排除原因、规范标签指向;排名层记录目标查询的位置、展示次数和点击率。三者混在一起,会把抓取故障误判为排名波动,也会把排名竞争误判为索引丢失。
下一步,选一个你正在关注的URL和一个目标查询,先做一次“检查URL”或等效抓取测试,把结果归入抓取、索引、排名中的一层,再只针对那一层收集证据。