在搜狗和 360 搜索里排查流量波动时,抓取、索引、排名是三个不同环节。抓取指搜索引擎蜘蛛是否来过、是否取走页面;索引指页面是否进入可检索的数据库;排名指某个查询下页面是否出现以及出现在什么位置。区分它们的方法是:先看服务器日志确认抓取,再用站内搜索或收录查询确认索引,最后用目标查询确认排名,三步结果不能互相替代。
如果只盯着“排名没了”,很容易把问题归错。按结果倒推,需要收集的资料和判断依据如下:
site: 查询、站内标题搜索,或搜索引擎站长平台提供的索引量数据。索引量下降不等于抓取失败,也可能是页面被判定为低质或重复。责任划分也随之明确:抓取异常通常归服务器、robots、链接结构;索引异常归内容质量、重复度、meta 指令;排名异常归关键词匹配、竞争页面、内容时效。
抓取是索引和排名的前提,但蜘蛛来过不代表页面会被索引。检查项包括:
noindex 指令。判断结果:有蜘蛛请求且返回 200,说明抓取环节基本正常;完全没有请求记录,优先查入口、robots 和服务器可访问性;有请求但返回异常,先修服务器或跳转链。
索引环节决定页面能否被查询命中。可执行步骤:
site:你的域名 查看大致收录情况,再用页面标题或唯一句子做站内搜索。site: 查不到,但日志显示蜘蛛刚抓取过,可能是尚未处理完,也可能是页面被判定为不值得索引。适用条件:新页面刚发布几小时就查收录,结果不稳定,应观察一段时间再判断。判断结果:能通过站内搜索找到,说明已索引;找不到但日志有抓取,问题在索引处理;日志无抓取,回到抓取环节。
排名是索引之后的竞争结果。检查方法:
假设例子:某页面日志显示 360 蜘蛛三天前抓取并返回 200,site: 能查到,但目标查询前五页都没有它。此时可以判断抓取和索引基本正常,问题集中在排名环节,而不是继续改 robots 或提交抓取。
出现具体问题时,按“抓取→索引→排名”的顺序收集证据,避免跳步。抓取看日志,索引看收录查询,排名看目标查询。每一步都记录时间、URL、查询词和结果,再决定下一步动作。下一步可以直接从服务器日志中导出最近七天的搜狗和 360 蜘蛛记录,对照目标 URL 建立一张抓取、索引、排名三列的状态表。