处理域名层面的重复或冲突信号,核心原则是“一个内容只保留一个规范域名入口”。如果你同时用带 www 和不带 www 的域名、http 和 https、多个旧域名或大小写混用的路径去指向同一批页面,搜索引擎可能把它们当作不同网址分别抓取和计算信号,导致权重分散、收录重复或展示网址不稳定。解决方式不是删掉所有旧入口,而是明确选定一个主域名,把其他入口做永久跳转,并让站内链接、站点地图和规范标签都指向同一个版本。
域名选择技巧在已有项目上的第一步,是分清冲突发生在哪个层面,因为不同层面的处理对象不一样。
http://example.com 与 https://example.com 同时可访问。这属于协议重复,通常应让 http 永久跳转到 https。example.com 与 www.example.com 都能打开同一页面。需要二选一作为主域名,另一个做 301 跳转。/page 与 /page/、/Page 与 /page 等变体。这属于 URL 规范化问题,靠服务器规则和规范标签收敛。判断方法很直接:分别用这些变体访问同一篇文章,观察是否返回 200、是否跳到同一最终地址、页面里的规范标签写的是哪个地址。如果多个变体都返回 200 且内容相同,冲突就已经存在。
主域名选哪个,取决于你已有的外链、品牌认知和证书配置。假设一个项目大部分外部链接指向带 www 的版本,那么把带 www 的版本定为主域名,通常比反过来更省事;如果两者外链接近,选更短、更符合品牌书写的那个即可。这里没有统一答案,关键是选定后不再反复更换。
具体做法:
http://example.com/a 跳到 https://www.example.com/a,而不是一律跳到首页。301 跳转解决的是“用户和爬虫被带到哪里”,规范标签解决的是“这一组相似 URL 里哪个是代表”。两者配合使用,但职责不同,不能互相替代。
在重复页面上放置指向主版本的规范标签,例如重复页写 <link rel="canonical" href="https://www.example.com/a">。注意规范标签应指向返回 200 的主版本地址,不要指向一个本身还会跳转的地址,也不要让 A 指向 B、B 又指回 A,这种互相指向会让信号无法收敛。
站点地图只提交主域名下的规范 URL。站点地图是抓取提示,不保证收录,也不保证被当作规范依据,所以它不能替代跳转和规范标签。如果站点地图里同时列出 www 和非 www 两套地址,等于主动把冲突喂给搜索引擎。
robots.txt 的抓取限制不等于可靠的索引移除。用 Disallow 挡住重复域名,只是阻止爬虫抓取,已经收录的地址仍可能留在索引里,而且爬虫看不到页面上的规范标签。所以对需要合并信号的重复域名,优先用 301,而不是用 robots.txt 屏蔽。
旧域名如果已经不再使用,正确顺序是:先保留旧域名并配置全站 301 到新域名对应路径,至少维持较长一段时间,让外部链接和用户都能被正确引导;确认流量和收录基本迁移后,再考虑是否停止续费。直接让旧域名过期,会把原有外链带来的访问直接断掉。
改完之后,用以下检查项确认收敛是否生效:
如果几周后仍有重复地址被展示,先确认跳转和规范标签没有互相矛盾,再检查是否有外部链接或旧站点地图仍在指向非主版本。下一步可以从外链最多的旧地址开始逐条核对,把仍然指向冲突版本的入口找出来。