抓取、索引和排名是三个先后不同、可以分别验证的环节。一个页面没有被抓取,就不存在被索引的机会;没有被索引,就不会出现在搜索结果里;已经被索引,也不等于能获得理想排名。在多人协作中,把这三件事混成一句“排名不好”,最常见的结果就是改错方向、反复返工。下面按观察、判断、处理、复查的顺序,说明怎样把问题拆开。
把问题落到具体页面上,先记录三个事实:该网址能否被抓取工具访问、搜索结果中能否找到该页、目标查询下该页处于什么位置。建议用一张交接表,每行一个网址,列清楚观察时间、使用的查询词、观察结果和操作人。
robots.txt 是否误屏蔽,页面是否需要登录或依赖脚本才能看到主要内容。site: 加具体网址或路径查询,看该页是否出现在结果中;也可以用页面标题的完整片段反查。这里要区分“可能原因”和“已经定位的原因”。例如页面搜不到,可能是尚未被抓取,也可能是被抓取后判定为重复或低质而未索引,不能只凭一个现象下结论。
判断顺序建议从后往前推,因为排名问题的前提是页面已经可被抓取、可被索引。
site: 查不到,重点检查是否被 noindex 标记、是否被规则屏蔽、内容是否与其他页面高度重复、页面是否长期没有内部链接指向。多人协作时,最容易返工的环节是把“未被索引”当成“排名差”来优化。前者要做的是让页面可被抓取、值得被收录;后者才涉及标题、内容结构和链接建设。方向不同,交付物也不同。
假设有一个产品页,目标查询词是“小型除湿机选购”,在搜索结果中找不到该页。按上述顺序操作:
noindex。noindex,再检查 robots.txt 和页面是否需要登录才能看到正文。site: 查询该网址,确认是否已被索引。复查时不要只看一天的结果。抓取和索引状态可能随抓取频率变化,排名也会因查询词、设备、地区而不同。建议固定查询词、固定观察方式,间隔一段时间记录一次,而不是凭单次截图判断成败。
给同事或客户的说明里,把结论写成“当前卡在哪一环、依据是什么、下一步做什么”,比写“排名需要优化”有用得多。例如:“该网址抓取返回 200,源码无 noindex,site: 查询未出现,判断为尚未索引;下一步补充内部链接并提交抓取,两周后复查索引状态。”这样的描述让接手的人能直接验证,减少来回确认。
下一步:挑一个当前表现异常的网址,按抓取、索引、排名三栏填写观察结果,把结论和依据一起交给协作方确认。