域名交易完成后,最容易被忽略的一步不是“立刻把 robots 写得更严”,而是要先把这个域名还要不要继续被百度抓取这件事弄清楚。对已经有收录基础的域名来说,robots 更像边界控制工具,不是修复收录波动的万能按钮。最稳的思路通常是优先放行主站和关键内容页,再按目录级别处理后台、测试页和重复参数,等解析、HTTPS、301 和站点地图都稳定后,再决定是否继续收紧。
如果你接手的是一个“百度收录型”域名,意思往往是它已经有一定历史抓取和索引记录。这种情况下,最怕的不是爬虫来得太多,而是你把该保留的入口一起挡住了。首页、核心栏目页、真实内容页、旧站迁移页,这些页面如果突然被全站屏蔽,百度看到的是访问边界变化,而不是一个更健康的网站结构。

一、交易后哪些页面必须继续被抓取
第一步是把“哪些页面不能丢”列出来。域名交易后,最该优先核对的是首页、核心内容页、历史上已经有收录价值的落地页,以及站点地图里准备继续维护的页面。只要这些页面还要参与收录和转化,就不适合一上来全站 Disallow。
这一步可以按三个问题判断:
1. 这个页面以后还会不会对外展示。
2. 这个页面是否已经有百度收录基础。
3. 这个页面会不会被新站结构继续使用。
如果三个答案里有两个是“会”,就应该先保留抓取权限。反过来,后台、测试目录、临时文件目录、重复参数页,通常才是 robots 该优先限制的对象。这样做的目的不是“让蜘蛛少来”,而是让它只来该看的地方。
一个实用判断是:只要页面还承担内容展示、品牌承接或迁移过渡的作用,就先让它保持可抓取。真正需要关门的,往往是不会对用户产生价值的目录,而不是整站。
二、百度收录型域名交易后 robots 怎么设置才稳
最稳妥的默认方案,是让主站保持允许抓取,再精确屏蔽无价值目录。思路可以简单概括成一句话:放行有价值页面,限制无价值页面,别用一刀切。
你可以把常见场景理解成下面这张判断表:
| 场景 | robots 方向 | 原因 |
|---|---|---|
| 接手后继续做内容站 | 允许主站抓取,只屏蔽后台和测试目录 | 收录需要持续抓取,主内容不能被误伤 |
| 旧站改版后保留历史内容 | 维持旧内容页可抓取,逐步清理无效页 | 方便百度识别迁移关系 |
| 只是更换持有人,不改站点 | 尽量不动核心规则,只检查是否有误封 | 交易动作本身不该打断收录 |
| 临时维护中的新站 | 短期限制部分目录,恢复后立即放开 | 仅在维护期减少无效抓取 |
如果你需要一个更接近实操的 robots 结构,可以按这个逻辑写:
```txt User-agent: * Allow: / Disallow: /admin/ Disallow: /test/ Disallow: /tmp/ Disallow: /search/
Sitemap: 站点地图地址 ```
这里的重点不是照抄格式,而是理解顺序。Allow: / 表示先把主站放开,再用 Disallow 去收紧无价值目录。对于已经有收录基础的域名,这种写法比“先全关再慢慢开”更稳,因为它不会让百度短时间内误判站点整体不可抓取。
如果你确实要临时屏蔽某个目录,也要尽量只屏蔽目录,不要把首页和主要内容一起挡掉。尤其是旧站迁移时,首页和历史内容页常常带着最重要的索引信号,误封的代价比你想象得大得多。
三、robots 之外,真正影响收录的三个开关
很多人把 robots 当成主开关,其实真正决定百度能不能稳定理解新站的,是解析、跳转和站点地图。
第一是 DNS 和解析是否稳定。域名刚交易完,如果解析还没完全生效,百度访问到的可能是旧站、空站或者错误页面。这个阶段最重要的不是改 robots,而是先让域名真正指向你现在的站点。
第二是 301 跳转是否明确。老域名换内容、换结构、换路径时,旧 URL 到新 URL 的跳转关系一定要稳定。否则百度会看到大量重复页、失效页或跳转链,收录质量会明显受影响。robots 只能告诉爬虫“哪里别看”,301 才是在告诉它“原来那页现在去哪了”。
第三是站点地图是否同步更新。站点地图最好只保留你还想被收录的页面,不要把后台、测试页、重复参数页一起塞进去。只要 sitemap 里还有大量无效地址,爬虫就会反复走偏,robots 再精细也很难完全兜住。
如果要给这三项排优先级,顺序通常是:先解析,再跳转,最后 robots 微调。很多收录波动并不是因为 robots 写错了,而是基础访问链路没理顺。
四、最容易把百度收录带偏的四种错误设置
第一种错误是全站 Disallow。很多人接手老域名后,担心爬虫抓到新内容不稳定,就直接把整个站封掉。短期看像是“清净了”,长期看却会让百度失去重新抓取和判断的机会。
第二种错误是把旧站规则原封不动搬过来。老站可能曾经有测试目录、活动目录或者临时参数规则,但你接手后这些目录结构已经变了,照搬只会把新站正常页面误伤。
第三种错误是把 robots 和 noindex 混为一谈。robots 更像门口保安,noindex 更像页面内部提示。你要减少收录,不一定只能靠 robots;你要删除某类页面,也不一定要先把整站封死。两者职责不同,不能混着用。
第四种错误是“屏蔽后不复查”。很多站点在交易后前两周改过 robots,后来就再也没人检查抓取日志、页面状态和 sitemap。结果是某个重要目录一直被挡着,过了很久才发现百度根本没重新进来。
只要出现下面这些信号,就说明 robots 规则该复查了:
- 核心页长时间不再被抓取。
- 旧收录页开始大量波动。
- 站点地图里有页面,但抓取日志里完全看不到。
- 新内容上线后,百度迟迟不更新。
这些信号出现时,先检查是否误封了关键目录,再看跳转和站点地图,不要第一反应就继续加严格规则。
五、按不同接手场景给出 robots 方案
不同接手场景,robots 的写法也不一样。真正该做的是“按用途收口”,而不是“按想法一刀切”。
| 接手场景 | 推荐动作 | 不建议做什么 |
|---|---|---|
| 只是变更持有人 | 保持主站可抓取,检查是否有误封规则 | 立刻全站屏蔽 |
| 老站继续运营 | 保留历史收录页,屏蔽后台和测试目录 | 直接清空原有规则 |
| 旧站改版迁移 | 先保证旧 URL 有明确去向,再逐步清理无效页 | 先封抓取再做跳转 |
| 新站重建 | 放行内容页,限制空页面和草稿页 | 把所有页面都关掉再上线 |
如果你希望收录尽快恢复,建议按这个顺序操作:
1. 确认域名解析和证书是否正常。
2. 再确认主站页面能稳定访问。
3. 然后检查 robots 是否误伤首页、栏目页和历史重点页。
4. 最后再处理后台、测试目录和重复参数。
这个顺序的核心逻辑很简单:先让百度能正常访问,再让它只访问该看的内容。顺序反过来,往往就会把原本可以保住的收录打散。
常见问题
域名交易后,robots 要不要马上改成全站允许?
不一定。更准确的说法是,先让主站保持可抓取,确认新站能稳定访问,再按目录级别收紧无价值页面。交易本身不会要求你把全站规则改得更宽或更窄,关键是别误伤原本要保留的收录页。
已经有百度收录的老域名,能不能直接屏蔽旧页面?
如果旧页面以后不再使用,可以逐步处理,但不要先把整个站一起封掉。对仍然承担流量、收录或跳转价值的页面,最好先保留访问,再结合 301、页面内容和站点地图一起调整。
交易后收录突然下降,最先查什么?
先查三件事:解析是否指向新站、关键页面是否返回正常状态码、robots 是否误封了核心目录。很多“收录下降”表面上像 robots 问题,实际上是访问链路或跳转链路出了问题。
旧站和新站目录结构不一样,robots 应该怎么写?
优先屏蔽后台、临时目录和测试页,其他内容页先保持开放。等百度重新稳定抓取后,再根据日志和收录表现决定是否进一步收紧。目录结构越不一样,越要避免全站式的大改动。
交易后的 robots 不是越复杂越好,越稳越好。只要你记住一个原则,答案就清楚了:保留该收录的入口,限制无价值的抓取,优先处理解析、跳转和站点地图,再去微调 robots。这样做,百度更容易重新理解这个域名,也更容易把原有的收录价值接住。






