抓取、索引、排名是三个先后环节:抓取是搜索引擎发现并获取页面内容,索引是把内容存入可供检索的数据库,排名是用户搜索时从索引中挑选并排序结果。判断当前卡在哪一环,最直接的方法是分别检查“页面能否被抓到”“页面是否在索引里”“目标词是否出现排名”,而不是只看搜索流量或排名波动。
要查的是服务器日志或抓取统计中的访问记录,重点看目标 URL 是否被搜索引擎爬虫请求过,以及返回状态码是否为 200。如果日志里没有该 URL 的请求,或者返回 4xx、5xx、被 robots.txt 拦截,问题在抓取环节,后续索引和排名都无从谈起。适用条件是你能拿到日志或抓取数据;若拿不到,可退一步用 site: 查询和 URL 检查类工具做初步判断,但结果不如日志确定。
要查的是该 URL 能否被站内搜索或 site: 查询命中,以及页面是否被标记为“已编入索引”或“已发现但未编入索引”。如果抓取正常、返回 200,但查询不到该页面,说明卡在索引环节,常见原因包括内容质量不足、重复页面、规范标签指向他页、页面需要登录才能看到主体内容。判断结果是:能查到且内容与目标一致,才进入排名观察;查不到,就先解决索引问题,不要急着改标题和正文。
要查的是用目标关键词在目标搜索引擎、目标地区、目标设备上搜索,该页面是否出现在结果中,以及大致位置。查排名时必须固定搜索条件,因为地区、语言、登录状态和个性化都会改变结果。如果页面已被索引,但目标词下没有它,说明问题在排名环节,需要检查该页面与搜索意图的匹配度、标题和正文是否覆盖该词、内链是否指向它、同类页面是否在互相竞争。结果是:有排名但位置低,属于可优化;完全无排名,先确认是否被其他页面替代。
site: 或站内搜索查该 URL,确认是否被收录。未收录,先解决索引,不碰排名优化。<link rel="canonical"> 是否指向自身。指向他页会导致该 URL 不被索引。优先顺序是抓取、索引、排名。抓取和索引没通过时,改标题、堆内容、发外链都不会让页面出现在结果里。下一步:挑一个目标 URL,按上面五项逐条记录结果,把不通过的那一项作为本周唯一要处理的工作。