抓取、索引和排名是搜索流程中三个先后不同、判定方式也不同的环节:抓取是搜索引擎发现并读取页面内容,索引是把读取到的内容存入可供检索的数据库,排名是在用户搜索某个词时从已索引内容中挑选并排序。判断问题出在哪一步,最直接的方法是看页面能否被抓取、是否出现在索引中、以及搜索特定词时是否出现,而不是只看流量多少。
把三者当成三条不同的验收标准,区分起来会清楚很多。
很多新手把“搜不到”直接等同于“被惩罚”或“排名差”,但更常见的情况是页面根本没被抓取,或者抓取了却没进索引。先确认前两步,再谈排名,能少走很多弯路。
下面这组检查可以按顺序执行,每一步的结论决定下一步做什么。
robots.txt 中的禁止项,或页面 <meta name="robots"> 中的 noindex。存在这类设置时,抓取或索引会被主动挡掉,属于配置问题而非排名问题。这套顺序的意义在于:只有前两步都通过,讨论排名才有前提。如果页面连索引都没有,调整标题、堆词或做外链都不会带来搜索结果的展示。
几个容易混淆的现象需要单独说明。
需要强调的是,同一现象可能有多个解释。例如搜不到某页面,既可能是没被抓取,也可能是被抓取后未被索引,还可能只是搜索方式不匹配。不要看到一种现象就断定唯一原因,应逐项排除。
对第一次接触这个问题的人来说,最实用的做法是固定一个检查习惯:每次发现页面没有搜索表现时,先记录三个信息——该页面是否被正常访问、是否允许被抓取、用独有文字能否搜到。这三项分别对应抓取、索引和“已进入可检索库”的判断依据。
当三项都通过、页面也能被搜到时,才进入排名分析:选定一个与页面主题一致的查询词,观察该词下页面的实际位置,再判断是内容相关性不足、页面主题分散,还是缺少外部引用。不同搜索引擎的抓取和索引机制并不完全相同,网页搜索、平台内推荐和付费广告也属于不同体系,不能用广告的展示位置去推断自然搜索的排名。
下一步,挑一个你手上已有的页面,用一段独有文字去搜索,确认它当前处于抓取、索引还是排名环节,再针对该环节做一项调整。