在SEO入门阶段,理解技术配置的适用条件,关键是先判断你的站点当前处于什么阶段、要解决的是收录问题还是体验问题。以robots.txt与noindex为例,两者都能阻止页面出现在搜索结果中,但适用条件完全不同:robots.txt适合阻止抓取,noindex适合阻止索引。选错会得到相反结果——用robots.txt屏蔽的页面,搜索引擎无法读取其上的noindex,页面可能仍被收录。
技术配置没有通用最优解,只有与当前问题匹配的解。开始动手前,先做一次观察:
site:你的域名查看大致收录范围,判断页面是没被抓取、抓取了没索引,还是已索引但排名不理想。<meta name="robots">、canonical、状态码是否符合预期。观察结果决定判断方向。如果页面根本没被访问过,问题偏抓取;如果被访问但未收录,问题偏索引或质量;如果已收录但点击少,属于展示与内容层面,技术配置能起的作用有限。
以“重复内容页面如何处理”为例,常见两种方案是规范化与屏蔽抓取。它们的适用条件可以这样对照:
判断依据是目标:要“合并权重、保留一个入口”选规范化;要“减少抓取、彻底不参与索引”才考虑屏蔽。若页面本身有搜索流量价值,屏蔽抓取通常不是合适选择。
确定方案后,执行时注意配置之间的相互作用:
<meta name="robots" content="noindex">时确认没有误加到全站模板。这里给一个假设例子:某站点有带参数的商品筛选页,参数组合产生大量近似URL。若这些页面没有独立搜索需求,屏蔽抓取参数路径是合理条件;若某个筛选组合有稳定搜索量,则应保留抓取并用canonical指向主商品页。判断结果取决于该URL是否值得作为独立入口存在。
复查不是看配置写没写,而是看搜索引擎的实际反应:
site:查询目标URL,观察是否仍出现在结果中,注意结果可能滞后。复查的适用条件是:你已明确本次改动想改变哪个现象。没有对照目标的复查,只会得到一堆无法解释的数据。
SEO入门阶段最容易犯的错,是记住“某配置有用”却记不住“对什么条件有用”。把每次决策压缩成三个问题:当前现象是什么、我期望改变什么、这个配置的前提条件是否满足。三个问题都能答清楚,再动手配置;答不清楚,就先继续观察。
下一步,挑一个你站点上真实存在的页面问题,按观察、判断、处理、复查四步走一遍,并记录每一步的依据。做过一次完整闭环,比背十条配置规则更有用。