抓取、索引、排名是三个先后不同、可分别验收的环节:抓取是搜索引擎发现并下载页面,索引是把页面内容分析、存储进可供检索的库,排名是用户搜索某个词时,系统从索引中挑出页面并决定展示顺序。判断问题出在哪一步,最有效的方法不是看感觉,而是从交付结果倒推:先看搜索里能不能找到这个页面,再看它进了哪个库,最后才看它排第几。
把最终想拿到的结果拆开,会得到三张不同的验收单:
site: 查询或页面级索引状态检查时,能看到该 URL,而不是“未收录”或“已抓取但未索引”。这三张单子不能互相替代。页面被抓取,不等于被索引;被索引,不等于对任意词都有排名。反过来,一个词没有排名,也不能直接推断页面没被抓取或没被索引。
实际工作中常要在两种方案间取舍:一种是把资源投在抓取与索引修复上,另一种是投在排名优化上。适用条件不同,判断依据也不同。
方案一:先修抓取与索引。适用条件是页面根本搜不到、索引状态异常、服务器对搜索引擎返回错误,或重要页面被规则挡住。此时做标题、内容、内链的排名优化,收益无法落地,因为页面还没进入可检索库。验收标准是抓取恢复正常、目标 URL 进入索引。
方案二:先修排名。适用条件是页面已确认被索引,但对目标查询词位置靠后或完全不出现。此时问题在相关性、内容覆盖、竞争强度或用户信号,继续检查抓取日志意义有限。验收标准是目标词下出现该 URL,位置可重复观察。
判断顺序建议固定为:先确认索引,再谈排名。因为排名观察本身依赖索引状态,索引不稳定的页面,排名数据也不可靠。
下面是一套可以直接执行的检查顺序,每一步都给出观察项和判断结果:
site: 加完整 URL 查询,或使用页面级索引检查。若查不到,回到第一步确认抓取;若显示“已抓取但未索引”,重点看内容质量、重复度和页面价值,而不是继续加外链。这套清单的价值在于:每一步都有明确的通过或不通过结果,避免把“没排名”直接当成“内容不好”,也避免把“没收录”误判为“排名算法惩罚”。
假设某产品页上线后搜不到。检查发现:服务器日志里有搜索引擎请求,状态码 200,说明抓取正常;但 site: 查询不到该 URL,说明未进入索引;此时谈排名没有意义。修复内容重复和入口问题后,页面进入索引,但对目标词仍无排名,这时才进入排名优化阶段。这个顺序说明:抓取、索引、排名各自有独立的验收结果,不能跳步判断。
下一步,挑一个你关心的页面,按上面的清单依次记录抓取、索引、排名三项结果,再决定把精力放在哪一环。