先给结论:如果同一事实在两篇文章里承担的任务不同——一篇用它做判断依据,另一篇用它做操作前提——保留两处、但各自只保留与任务相关的那一面,通常比强行合并更省事。若两处承担的任务相同,只是换词复述,就应合并到更权威的一篇,另一篇改为引用或直接删除。判断依据不是“出现了几次”,而是“删掉这一处,读者还能不能完成下一步动作”。
同一个行业事实,在不同文章里往往扮演不同角色。依据型事实用来支撑一个结论,例如某类材料的耐温区间被用来论证选型边界;前提型事实用来开启一段操作,例如同一耐温区间被当作计算余量的输入。两者的读者动作不同:前者要判断“能不能用”,后者要判断“留多少余量”。
这种情况下保留两处是合理的,但每处只写与自身任务相关的那一面。依据型那篇可以写区间来源和适用条件,前提型那篇只写取值和代入方式,不必再解释一遍来源。这样两篇文章各自完整,读者不会因为跳转丢失上下文,冗余感也会下降。
反过来的情况是,两篇文章都用同一事实说明同一件事,读者读完两处得到的信息完全一致。这时保留两份只会稀释可信度:读者会怀疑哪一篇才是正式口径,后续修改时也容易只改一处,造成两篇文章互相矛盾。
合并的代价是其中一篇会失去一个段落,可能显得单薄。可接受的补偿是把它改成指向另一篇的明确引用,并补上本篇特有的判断,例如适用边界、常见误用或与相邻概念的区分。如果补不出这类内容,说明这篇文章本身缺少独立任务,问题不在冗余,而在选题重叠。
假设某行业设备的标准工作区间是同一组数值。选型文用这组数值回答“什么条件下不该选这个型号”,排障文用同一组数值回答“现场读数偏离多少才需要停机检查”。
如果两篇都完整复述数值来源、测试方法和历史沿革,读者会在第二篇里再次读到相同段落,产生重复感。更合理的做法是:选型文保留来源和适用条件,排障文只保留阈值和判断动作,并用一句话说明该阈值的依据见选型文。假设排障文后来需要独立发给现场人员,不能依赖跳转,那就把依据压缩成一句结论加一个条件,而不是整段搬回。这个取舍取决于读者是否会在离线或单篇场景下阅读,而不是取决于哪篇权重更高。
减少冗余不是一次性编辑,而是持续维护。可以做一个简单动作:把反复出现的事实列成清单,每条记录三件事——事实的完整表述放在哪一篇、其他文章是引用还是压缩复述、修改时以哪一篇为准。
做完这个动作后,下一次新增文章时先查清单:如果事实已有归属,就只写与本篇任务相关的那一面,并指向归属篇;如果发现同一事实在三篇以上被完整复述,说明归属篇需要补强,而不是继续分散。这个动作的结果会直接影响下一篇的写作范围:清单越清晰,新文章越容易判断哪些内容该写、哪些只需一句带过。
需要提醒的是,某篇文章的抓取量或站内点击下降,不能单独证明是冗余处理造成的。可能是入口变化、需求转移或页面本身的任务不再成立。把现象和原因分开记录,才不会用一次数据波动去否定一个本来成立的合并决定。