先给结论:不要试图让每个域名都“被收录得一样多”。索引量查询在这里的作用是核对分工,而不是追求总量。合理做法是先确定一个主域名承担主要检索入口,其余域名按重定向、独立品牌站或测试站三种用途分别处理;如果多个域名都返回可索引的相似正文,索引量分散本身就是预期结果,需要改的是用途说明和信号,而不是去申诉数字。
多个域名出现相似内容,常见有三种成因,处理方式完全不同。第一种是同一套内容被复制到不同域名,正文几乎逐字相同,只有页头页脚或货币、语言不同。第二种是不同域名面向不同地区或语言,正文主体结构相似,但标题、价格、法规说明、联系方式有实质差异。第三种是测试域名、旧域名或备用域名仍在对外提供可访问页面,本不该进入检索结果。
区分方法不靠感觉。抽取每个域名下同一路径的若干页面,逐项比对:标题是否一致、正文段落重合比例、是否有独立的本地化信息、canonical 指向哪里、页面是否返回相同的 HTTP 状态。若正文重合但本地信息真实存在,属于第二种;若连本地信息都是批量替换,基本属于第一种。这个判断决定了后面是保留、改写还是退出。
保留多个可索引域名的前提,是每个域名都能独立回答一类查询,并且用户在这些页面上能完成不同任务。典型条件是:面向不同国家或语言,有本地客服、本地支付、本地合规说明;或者面向不同产品线,内容虽有交集但导航和转化路径不同。
保留时要做三件事。第一,在每个域名上明确写出该站服务谁、覆盖什么范围,让用途可被读取,而不是只靠运维文档记录。第二,canonical 指向本站对应页面,不要跨域名互指,否则等于自己宣告谁主谁次,却又不一致。第三,站点地图只列本站希望被检索的 URL,不要把其他域名的地址混进来。做完这些后,用索引量查询观察每个域名是否只收录了各自范围内的页面;如果某个域名开始收录不属于它职责的路径,说明用途边界没有在链接和导航上落实,下一步应回到站内链接结构,而不是先改 robots.txt。
如果两个域名必须同时存在,但内容确实高度相似,改写是比直接删除更现实的选择。适用前提是:两边都有真实流量来源或业务依赖,不能立刻下线;同时团队有能力为其中至少一个域名重写标题、导语、核心段落和内部链接锚文本。
改写不是换同义词。有效做法是让每个域名围绕自己的用户问题重组内容:一个侧重选型对比,一个侧重安装或使用步骤;一个按地区写清配送与退换,一个按行业写清合规要求。改写完成后,索引量查询应显示两边收录的页面集合出现分化,而不是继续同步增减。若两边索引量仍然同步变化,说明模板、导航和互链还在把两个域名绑在一起,需要先拆互链再评估。
当某个域名没有独立检索价值,退出是正确选择。退出不等于直接删站,也不等于只加一条抓取限制。robots.txt 的抓取限制不等于可靠的索引移除:它阻止抓取,却不会让已经进入索引的地址自动消失,也无法阻止其他页面链接到它。站点地图不保证收录,反过来,从站点地图移除也不保证移除索引。
可执行的顺序是:先把该域名上仍有价值的页面 301 到主域名对应页面,并确保目标页面可访问、内容对应;再对没有对应目标的路径返回 410 或 404;然后检查站内和其他站点是否还有指向旧域名的链接,逐步替换。做完一轮后,用索引量查询按域名分别核对,看旧域名的收录是否随抓取和链接减少而下降。如果数字不动,先查是否还有大量外部链接指向旧地址,而不是反复提交删除请求。
索引量查询出现与直觉相反的结果时,先列出至少两种合理解释,再找证据区分。例如主域名索引量下降、旧域名没有同步下降,可能解释一是旧域名仍在被外部链接引用,可能解释二是主域名改版后新 URL 尚未被充分抓取。区分办法是抽查旧域名的入站链接来源,同时核对主域名新 URL 是否出现在站点地图和站内链接中。
再如两个域名索引量同时归零,不能单独证明某次配置正确。抓取工具故障、查询口径变化、站点整体不可访问、robots.txt 误封全站,都会产生类似现象。此时应先用 site: 之外的抽样方式直接访问若干 URL,确认返回状态和页面内容,再回看索引量。只有把访问结果、状态码、canonical 和链接来源放在一起,才能判断是分工生效还是站点出了故障。
最后用一个假设例子收束:假设 A 域名是主站,B 域名是旧站,两边正文相似。若 B 域名仍有外部链接和少量品牌查询,直接 301 到 A 的对应页面,并保留 B 域名解析至少一个观察周期,通常比同时维护两套可索引内容更容易解释索引量变化;若 B 域名没有任何独立链接和查询,则可直接走退出流程。无论选哪条路,先写清每个域名服务谁、承担什么查询,再决定保留、改写还是退出,索引量查询才有可对照的基准。