合并前先做一次“独有信息盘点”,而不是直接比较谁的字数多。把两页拆成可独立判断的信息单元,逐条标记“两页都有”“只有A有”“只有B有”“两页说法冲突”,再决定合并后的页面保留哪些、删哪些、改哪些。这样做的原因是:答案相近只说明主题重叠,不代表细节相同;真正决定合并质量的是那些只出现一次的事实、条件、示例和边界说明。
答案相近不是合并的充分条件。假设某站有两篇介绍同一类操作的页面,一篇讲通用流程,另一篇讲在特定条件下流程会怎样变化。两页的核心结论相似,但第二篇包含独有适用条件。此时直接删掉第二篇并把它的标题指向第一篇,读者会失去那组条件信息。
可以用三个信号区分:
如果第三条不成立,优先考虑保留两页并明确各自定位,而不是强行合并。合并的价值来自减少重复,不是消灭所有相近内容。
把每页内容切成信息单元,粒度可以是一句话、一个条件、一个步骤或一个例子。对每个单元只问两个问题:它是否影响读者做决定?它是否只在其中一页出现?两个都答“是”的单元,就是合并时必须保留的独有信息。
实际操作时,先列一张对照清单:
完成清单后,合并页的骨架就来自“共有”部分,独有信息作为补充条件、例外说明或示例嵌入对应位置。这样既减少了重复,也不会因为合并丢掉关键差异。
以下情境为假设,用于说明判断方法,不代表任何真实站点结果。
假设某站把两篇答案相近的页面合并为一篇,保留了两页共有的步骤,也补入了B页独有的适用条件。合并后一段时间内,原有关键词带来的访问量没有明显上升,甚至部分日期低于合并前。这时容易得出“合并失败”的结论,但还有几种合理解释:
要区分这些解释,先核对合并前后的搜索需求趋势,再看新页面是否仍能覆盖原来由两个页面分别承接的查询表达。如果需求本身下降,短期访问减少不能归因于合并;如果需求平稳但原独有表达消失,则问题更可能出在信息保留环节。
独有信息不只是事实和数据,以下三类最容易被忽略:
检查时可以直接在新页面上搜索原两页的独有短语或条件词,确认它们是否仍然出现。如果某条独有信息无法自然融入新页面,说明它可能值得单独保留,而不是硬塞进合并页。
按以下顺序操作,能减少合并后反复修改:
其中第三步是决定合并质量的关键动作:独有信息被改写成新页面的一部分,而不是被删除或原样堆砌,读者才能在不重复阅读的情况下获得完整答案。这个动作的结果会直接影响下一步——如果独有信息保留完整,后续只需观察覆盖情况;如果保留不完整,优先补回信息,而不是急于再次合并或拆分。