先给结论:不要试图用一句“这是主站、那是备用”就解释清楚。百度判断多个域名时,真正需要的是让每个域名有可被独立识别的用途,并且这种用途在页面、链接和抓取规则上保持一致。如果只是内容几乎一样、互相指向,收录表现通常不会因为一句说明而改变。
常见情况是:同一套内容放在两个域名下,一个域名有收录,另一个几乎不出现。有人据此认为百度“只认一个域名”,于是把所有资源压到其中一个上。但这个结论并不牢靠。另一种解释是,两个域名虽然内容相似,但外部链接、访问速度、页面模板、抓取频率和历史路径不同,百度只是按各自信号分别处理,并非主动做了二选一。
还有一种更隐蔽的情况:两个域名都未被大量收录,但原因不同。一个可能是抓取正常、索引筛选后未展示;另一个可能是抓取本身就少。把这两种情况混在一起,就会误判为“相似内容被合并”。
解释一:百度识别到高度相似的内容,选择保留其中一个域名的结果,另一个进入补充或低优先级状态。解释二:百度并没有做明确的合并判断,只是因为某个域名的内链结构、外链来源或抓取入口不足,导致它本身就没有获得足够的抓取和索引机会。
这两种解释对应完全不同的动作。若是前者,重点在于明确主次关系并减少无意义的重复;若是后者,重点在于补足每个域名自身的可抓取路径和独立价值,而不是急着做跨域 canonical 或全站跳转。
在缺少完整数据和权限时,仍可以执行一个最小动作:分别查看两个域名在百度搜索资源平台中的抓取频次和索引量趋势,再看各自是否有独立的外部链接和站内入口。如果域名 A 抓取正常、索引量稳定,域名 B 抓取极少、外链几乎为零,那么更可能是解释二。如果两个域名抓取都正常、内容高度一致,但只有一个域名的页面能稳定出现,另一个长期不出现,则更接近解释一。
这里有一个重要限制:抓取量下降或索引量归零,不能单独证明百度做了合并处理。服务器临时不可用、robots.txt 误封、站点地图失效、页面模板改版,都可能造成类似现象。需要结合时间点和改动记录排除这些原因,再下判断。
另外,robots.txt 的抓取限制不等于可靠的索引移除。即使禁止抓取,已收录的 URL 仍可能因为外部链接而出现在结果中。站点地图也不保证收录,它只是提供发现路径,不构成收录承诺。这些工具可以用来辅助判断,但不能当作合并与否的直接证据。
如果确认两个域名都需要保留,建议按以下顺序处理:
执行上述动作后,下一步取决于观察结果:如果域名 B 的抓取开始覆盖核心路径,说明它此前的问题是入口不足,可以继续补充独立内容;如果抓取正常但索引状态仍无变化,再考虑是否需要对重复页面做更明确的合并或跳转处理。
假设某站点有 example.com 和 example.net,两者内容几乎相同。如果 example.net 只是旧域名的备份,且没有独立外链,那么更合理的做法是让 example.net 的页面逐步跳转到 example.com 的对应页面,而不是保留两套完全一样的内容。如果 example.net 是面向特定地区的独立版本,就应保留其独立页面,并补充该地区特有的信息,同时避免两个版本之间无差别互链。
这个例子的关键不是选哪个域名,而是先确认用途是否真实存在。用途不真实,任何说明都只是文字游戏;用途真实,就需要让它在页面、链接和抓取规则上同时成立。
最后提醒一点:HTTPS 不保证安全无漏洞,也不保证排名。它只是影响判断的众多因素之一,不应作为解释两个域名收录差异的主要依据。真正需要先确认的,是两个域名各自的抓取是否正常、索引是否被筛选,以及它们之间是否存在可被百度识别的独立用途。