抓取、索引和排名是三个独立环节:抓取是搜索引擎发现并读取页面,索引是把可用的页面内容存入可检索的数据库,排名是用户搜索时从已索引内容中挑选并排序结果。判断问题出在哪一步,最直接的方法是看页面能否被抓取、是否已进入索引、以及针对具体查询是否出现。人手和时间有限时,先处理“抓取被阻断”和“页面未被索引”,再谈排名优化。
要查的是页面有没有被技术手段挡住。打开目标页面的 HTML 源码,检查 <meta name="robots"> 是否写了 noindex 或 nofollow;再查看站点根目录的 robots.txt,确认没有用 Disallow 屏蔽该路径。如果页面需要登录才能看到主体内容,搜索引擎通常也无法抓取。
结果说明:若发现 noindex 或 Disallow,页面根本不会进入索引,后面谈排名没有意义。若这些都没有,只说明“允许抓取”,不代表已经被抓取。
要查的是页面有没有被收录。用搜索引擎的站内查询语法,例如输入 site:你的域名 页面标题关键词,看目标页面是否出现在结果中。也可以直接搜索该页面的完整标题或一段独特正文。注意,网页搜索、平台推荐和付费广告是不同系统,广告出现不代表自然索引存在。
结果说明:搜索不到不等于一定没索引,可能只是没有被该查询召回;换用更独特的标题或正文片段再试。若多个独特片段都搜不到,优先怀疑未索引。若已索引,才进入排名环节。
要查的是针对具体查询词,页面是否出现在结果里。用目标查询词搜索,观察前几页有没有该页面。如果页面已被 site: 查询确认索引,但目标词搜不到,说明问题在排名,不在抓取或索引。
结果说明:索引是“有没有资格被检索”,排名是“某个词下排第几”。一个页面可以被索引,却在某个词下排名很低或没有进入可见结果。此时应检查内容与查询意图是否匹配、标题和正文是否清楚表达主题,而不是继续改抓取设置。
robots.txt 和页面 meta robots。有阻断就先解除,再等重新抓取。site:域名 独特标题词 搜索。搜不到就换独特正文片段再试,仍搜不到按未索引处理。适用条件:这套顺序适合时间和人手有限、需要决定先做什么的情况。判断结果只有三种:抓取被阻断,先修抓取;允许抓取但未索引,先解决可发现性和内容质量;已索引但无排名,才进入排名优化。不要跳过前两步直接改标题或堆内容。
挑一个你关心的页面,按上面的清单从抓取查到排名,把结果写成三行:是否允许抓取、是否已索引、目标词是否有排名。哪一行最先失败,就先处理哪一行。