抓取、索引和排名是三个先后不同、失败表现也不同的环节。抓取是Googlebot发现并读取网址;索引是Google把页面内容存入可供检索的数据库;排名是用户搜索时,Google从已索引内容中挑选并排序结果。一个页面没流量,可能卡在抓取、卡在索引,也可能已被索引但排名不佳,不能把它们统称为“没被收录”。
在搜索结果里看不到某个页面时,多数人第一反应是“排名不好”。但排名的前提是页面已经进入索引;索引的前提又是Googlebot成功抓取并理解页面。如果抓取阶段就被 robots.txt 阻止,或返回了 noindex,页面根本不会进入候选集合,此时谈排名没有意义。
另一个常见误解是:提交了网址或站点地图,就等于被索引。提交只是把网址告知Google,是否抓取、何时抓取、是否保留索引,仍由Google根据自身判断决定。谷歌SEO最佳实践在这里的含义是:把抓取、索引、排名当成三个可分别检查的环节,而不是一个“提交即生效”的开关。
第一次排查时,可以按下面顺序逐层确认,前一层不通过,就不要跳到下一层找原因。
noindex 标签,canonical 指向的是自身而非其他网址,内容不是空白或与已有页面高度重复。若这些条件不满足,问题属于索引层。判断结果的方法很直接:如果网址检查显示“已抓取,尚未索引”,说明抓取通过、索引未完成;如果显示“已编入索引”,那么没有流量就应从排名和查询意图上找原因,而不是继续修改抓取设置。
假设某产品页上线两周,搜索品牌词加产品名也找不到。第一种情况:robots.txt 误写了 Disallow: /product/,Googlebot 无法抓取,这属于抓取问题,删除规则后重新提交即可。第二种情况:robots.txt 正常,但页面模板里带了 noindex,Google能读但不会保留索引,这属于索引问题。第三种情况:抓取和索引都正常,但页面标题只写“首页”,内容也没有回答用户查询,这属于排名问题,需要改标题、补充实质内容并改善内链。
三种情况的修改动作完全不同。把抓取问题当成排名问题去堆关键词,或者把排名问题当成索引问题反复提交网址,都不会解决根本原因。
新页面刚发布、改过网址结构、调整过 robots.txt 或 canonical 时,优先看抓取和索引。老页面长期有索引但流量下滑时,优先看排名与查询意图变化。适用条件是:只有确认前一环节已通过,后一环节的检查才有诊断价值。若你无法确认页面是否已被索引,先做索引检查,不要直接进入排名优化。
下一步:挑一个你关心的具体网址,依次记录它的抓取状态、索引状态和针对一个真实查询词的排名表现,再根据卡住的那一层决定修改动作。