系列上一篇讲了一篇长文怎么一步步读薄,这篇聊个更底层的问题:一个东西,在库里叫了好几个名字。
举个真的。同样是「大模型微调」这件事,有的笔记写「微调」,有的写「Fine-tune」,有的写「调参」。三个词,指的是同一件事。搜「微调」出来一篇,另外两篇沉在底下,自己存过都想不起来。
这种混乱,单看一篇笔记看不出来,一搜就露馅。
术语是从哪儿混起来的?大致三个来源。自己不同时期叫法不一样,半年前写「微调」,现在写「调参」。抄来的外部文章,作者各有各的说法。翻译过来的词更是花样多,同一个 agent,一本书翻「智能体」,另一本翻「代理」。三股合到一块,库里就乱了。

术语不统一,麻烦在哪
头一个是搜不到。脑子里想的是 A,库里存的是 B,一个词对不上,明明存过的东西就像没存过。
第二个是链接连不上。在笔记里写「参见 [[微调]]」,可那一篇偏偏叫「Fine-tune」,双链连不上,库里的网就断了一处。这种断点多了,链接体系慢慢就废了。
第三个是 AI 也懵。把几篇笔记丢给 AI 归纳,它看到三个词,会当成三件事,分别总结一遍。术语不统一,喂进去的料就是散的。
第一步:定一个正名
办法不复杂。同一件事,先挑一个最常用的叫法当正名,剩下的都算别名。
正名怎么挑?用平时嘴上会说的那个。跟人聊起来张口是「微调」,正名就用「微调」,别为了显得专业去用「Fine-tune」。
定了还得写下来。只在脑子里定,过两个月自己又混。
第二步:别名登记在笔记里
Obsidian 的 frontmatter 有个 aliases 字段,专门放别名。可以一行一个,也可以写成数组:

—
title: 大模型微调
aliases: [Fine-tune, 微调, 调参]
—
好处很实在。搜索栏里不管敲哪个词,都能搜到这一篇;写 [[链接]] 的时候敲别名,也能连上。
别名不用一次补全,常用的那几篇先补。以后碰到了再回来加。
第三步:建一张术语表
再往前一步,建一张专门的术语表笔记,把会混的同义词、缩写、中英对照集中记下来。
放什么?放那些真会混的。比如「RAG」和「检索增强」,比如「Agent」和「智能体」,同一个概念两个叫法,这种才值得登记。不是每个词都往里放。
术语表本身也能自动维护。笔记里带了 aliases 的,用 Dataview 一句就能列出来:
TABLE aliases
WHERE aliases
改了哪篇的别名,这张表跟着更新,不用手工抄。

三个容易踩的坑
头一个是只定不登记。口头说好统一用「微调」,可笔记里的 aliases 没写,过俩月照旧混。定正名的价值,全在登记那一步。
第二个是术语表塞太满。恨不得每个名词都放进去,术语表慢慢变成另一个要维护的库。只放真会混的,别贪多。
第三个是只顾新笔记。新写的都统一了,可搜索栏里还是进不去旧的那几篇。改的时候先看入口,把别名补齐,正文里的旧叫法不用一篇篇去改。
术语统一这件事,平时看不出收益。等到某天搜一个词搜不到、双链连不上的时候,才发现当初多写一行 aliases 能省不少事。
前几篇讲了搜不到排查、内容复用,还有怎么把一篇长文读薄。这篇讲了术语怎么统一。后面接着聊些零碎但天天要碰的小事,下一篇来说说知识库里「待办」怎么记。