系列上一篇讲了「专题研究」四步法,这篇说说另一个绕不开的问题:同一件事记了三遍。
重复笔记是知识库变大的必然产物。几万条笔记,同一个主题收了三五次,太正常了。不处理的话,搜索时出来一堆相似结果,不知道信哪条,越看越乱。
处理完,搜索结果干净,笔记之间不打架。这篇讲我怎么合并。
重复从哪来
先认清来源,才好对症。我遇到的重复有三种:
捕获时顺手记。 手机上记一条,电脑上又记一条,内容七八成像。这个最普遍。
渠道重复。 同一个资料,网页剪藏一次,公众号又存了一次,内容一模一样。
换名字记。 同一套方法论,今天叫「任务管理」,明天叫「 GTD 」,细看内容八成像。这个最难认,因为标题都不一样。
怎么发现
发现重复比合并更重要。我常用三个办法:
搜核心词。 不确定哪几篇重复,就搜这个主题最核心的一个词。搜索结果按相关度排,标题相近的一眼就能看出来。
文件名排查。 按主题分目录的话,同名或近名的文件列一起,逐个打开比一下,10 分钟能过完一个目录。
Dataview 聚合。 用 Dataview 按标签或文件名关键字分组,把所有疑似重复的笔记列在一张表里,谁跟谁重复一目了然。之前讲 Dataview 那篇提过类似的用法,这里正好用上。
合并四步
找到重复之后,按下面四步合并。一次只处理一组,别贪多。
第一步:定主笔记。 保留信息最全、结构最清楚的那篇。通常后写的那篇吸收了前面的经验,内容更完整,适合当主笔记。
第二步:内容并集。 把其他几篇里独有的信息搬进主笔记,按逻辑归位,不按时间堆。搬完回头读一遍,确认没有遗漏。
第三步:链接迁移。 把指向被删笔记的双向链接,改成指向主笔记。Obsidian 设置里打开「自动更新内部链接」,移动文件时它会自动改,省不少事。
第四步:处理元数据。 tags 和 aliases 合并成一套,重复的删掉。frontmatter 统一,日期、来源、状态都对齐。这步不做的后果是,以后用 Dataview 统计时,同一个主题会出现在两套标签下。
怎么防止再重复
合并是被动补救,主动防才是正路。我现在的习惯:
记之前先搜 30 秒。 有就追加到已有笔记里,不新建。这是最有效的一招,成本最低。
命名守规矩。 同一类东西用同一个词开头,比如「任务管理-…」「 GTD -…」。文件名相似度高,重复一眼能认出来。
一个主题一条笔记。 宁可笔记长一点,也不拆成好几篇。笔记变长之后,自然会去重组,而不是开新篇。
每月扫一遍。 配合之前讲的「体检」节奏,每个月花 20 分钟过一遍新笔记,发现重复当场合并。时间越短,合并越省力。
前几篇讲了采集、整理、搜索、备份、输出、去重。系列还剩一个话题:知识库用了这么久,怎么判断它到底有没有用。下一篇来说说价值复盘。