先给结论:不要试图用一份 robots.txt 或一个 canonical 标签把多个域名的关系“藏起来”,而要在每个域名上明确写出它服务谁、承载哪一段内容、与主域是什么关系。只有当两个域名面向不同地区、不同语言或不同业务线,且各自有独立入口时,分开承载才成立;如果只是同一批页面换域名,则应合并或做 301,而不是靠说明文字维持。
把手上所有能打开相似内容的域名列出来,对每个域名回答三个问题:它是否有独立导航和独立转化路径;它的内容是否只对某一类用户可见;它是否被外部链接或广告单独指向。三个问题都答“是”,才属于功能分工。只要有一个答“否”,更可能是重复投放,此时说明用途并不能解决问题,应该先决定保留哪一个。
一个可区分的证据是:打开两个域名的同一页面,比较页面标题、面包屑、页脚联系方式、结算入口是否一致。如果除域名外几乎完全一致,说明它们没有各自用途,继续写说明只会让维护成本更高。
确认要保留多个域名后,不要只在首页写一句“本站为某某站点”。更可靠的做法是在每个可能被单独访问的页面上,用可见文字和结构化信息同时说明归属。具体动作如下:
<head> 中保留自引用 canonical,指向该域名下这一页的规范地址,而不是全部指向主域。做完这一步后,下一步是观察:在站点地图提交后的抓取记录中,看两个域名的 URL 是否仍被交替抓取。如果仍交替,说明内容差异不足,需要回到上一步继续拆分或合并,而不是继续加说明文字。
搜索引擎如何处理重复内容,与用户是否能选对入口是两件事。多个域名承载相似内容时,真正的风险是用户从搜索结果进入了一个不适合他的版本。因此说明的重点应放在:这个域名服务哪类用户、从哪个入口进入、进入后能完成什么。
假设有一家已有实际业务的公司,主域面向全国,另有一个域名只面向某个城市。两个域名上都有相似的服务介绍。此时可以在城市域名页面显著位置写明“本页仅面向某某城市用户,其他地区请访问主域”,并在主域对应页面写明城市入口。这个动作的结果是:用户能自行选择,而不是在两个相似页面之间来回跳。若城市域名没有独立客服、独立价格或独立服务范围,那么它就不该单独存在。
用 robots.txt 屏蔽某个域名,或在页面加 noindex,只能影响抓取或索引处理,不能替代用途说明。robots.txt 的限制不等于可靠的索引移除;即使屏蔽了抓取,已收录的 URL 仍可能出现在结果中,直到被重新处理。站点地图也不保证收录,提交了不等于会被采用。
如果两个域名已经同时存在很久,先检查是否还有外部链接或广告指向将被合并的域名。若有,先更新这些指向,再执行 301,否则用户会落到已经不再维护的版本上。这个顺序会影响下一步:链接更新完成后再做合并,能减少中途出现的死链和错误入口。
HTTPS 只保证传输加密,不保证页面安全无漏洞,也不构成排名保证;它不能用来证明某个域名更该被保留。最终判断标准仍然是:这个域名是否有独立用户和独立用途,以及用户能否从入口处就知道自己该进哪一个。