把“百度改版”拆成页面任务,核心不是先改模板,而是先判断改版影响了哪一层:抓取、索引还是展现。做法是先固定证据,再把每个异常现象对应到具体页面、具体模板、具体字段,最后才决定改什么。下面这份清单按“查什么—怎么查—结果说明什么”组织,适合在改版上线后出现流量或收录波动时逐项核对。
查什么:本次改版到底改了哪些页面类型,是全站模板、栏目页还是详情页;上线时间点与波动时间点是否吻合。
怎么查:调出改版前后的页面截图或版本记录,列出受影响的 URL 模式,例如 /list/ 栏目页和 /item/ 详情页。再对照百度搜索资源平台里的抓取统计与索引量趋势,看变化出现在哪一天。
结果说明什么:如果波动只出现在某一类模板,问题大概率在该模板的代码或内容结构,而不是全站策略;如果所有页面同时下滑,才需要往服务器、robots、全站跳转方向查。
查什么:改版是否误改了 robots.txt、meta robots、canonical,是否新增了拦截百度的规则。
怎么查:直接访问 /robots.txt,确认没有 Disallow: / 这类全站屏蔽;抽查几个关键页面的 HTML 源码,看 <meta name="robots"> 是否为 noindex;检查 canonical 是否指向了错误地址。再用百度搜索资源平台的抓取诊断工具测试几个代表性 URL。
结果说明什么:抓取诊断返回“拒绝访问”或“robots 限制”,说明问题在抓取层,此时页面内容改得再好也不会被正常收录。若诊断正常但索引量仍下降,问题后移到索引或展现层。
查什么:改版后哪些原本被收录的 URL 变成了未收录,是否因为 URL 结构变化产生了大量 404 或软 404。
怎么查:用 site: 查询配合日志或资源平台的索引量数据,抽取改版前后各 20 个样本 URL 逐一访问。重点看旧 URL 是否 301 到新 URL、新 URL 是否返回 200 且内容完整。对返回 404 的旧地址,确认是否有对应的新地址可跳转。
结果说明什么:旧 URL 直接 404 且无跳转,等于主动丢弃已积累的索引信号;旧 URL 301 到新 URL 但新页面内容缺失,则属于跳转后价值不对等。两种情况都要回到页面任务清单里补跳转规则或补内容。
查什么:改版是否把正文、标题、导航、内链结构改得难以理解,是否把文字内容换成了图片或异步加载。
怎么查:关掉 JavaScript 或用抓取工具查看渲染前后的 HTML,确认正文是否直接出现在源码中;检查 <title>、<h1>、<h2> 是否仍然唯一且描述页面主题;抽查内链是否还能从栏目页点到详情页。
结果说明什么:正文只在 JS 渲染后出现、标题重复或缺失、内链断裂,都会让搜索引擎难以判断页面主题。这时页面任务应写成“修复某模板的正文输出方式”或“补回某栏目的内链路径”,而不是笼统地写“优化内容”。
完成以上核对后,把每个确认的问题写成一条任务,包含四要素:受影响页面范围、当前证据、要改的具体位置、验证方式。例如:
/item/ 下全部页面。证据:抽查 5 个页面 canonical 均指向首页。改法:改为输出当前页面 URL。验证:改后重新抓取诊断,确认 canonical 与页面地址一致。/old-list/ 下的地址。证据:这些地址现返回 404。改法:按新旧对照表配置 301 到对应新栏目。验证:逐个访问旧地址,确认跳转到内容对应的新页面。判断任务是否拆得够细,标准是:执行的人不需要再猜“改哪里”,验收的人能用一个具体地址复现结果。如果一条任务无法用某个 URL 或某个模板来验证,说明它还停留在方向层面,需要继续拆。
下一步,先选一个受改版影响最明显的页面类型,按上面五步走一遍,把确认的问题写成任务清单,再决定是否扩展到全站。