在文件夹系统阙如的 Calibre 中,标签是重要的组织方式。它既是自由,同时也是束缚。自由之处在于,你不必像图书管理员那样另书籍与其位置(文件夹)一一对应;局限则硬币的另一面,恰因解开了束缚,你很可能忘了自己以前用过哪些标签,假以时日,标签遂成一团乱麻。
在传统图书行业中,早有人意识到了标签的问题。比较讲究的管理人员和学者引入受控标签,即领域同侪约定成熟的信息,理想情况下,它们通常从抽象到具体,可以排成一个相对规范整齐的金字塔层次结构。然而,标签天然一盘散沙的呈现方式无法体现其间的层级关系,结果就是一个外行难以看懂论文开头的关键词阵列,而许多作者也有敷衍之嫌。
或许我们要考虑带层级编码的标签,重新赋予标签秩序,并简化本地书库搜索。
从普通标签到层级编码
在撰写《信息管理,文件为本位的方案》时,我曾考察过标签的作用:
面对文件夹和标签这一堆工具中,我们最好保持理智:你可以做一件事情时,并不意味着你必须这么做;标签确实可以替代文件夹——如果它没有失效的话——但不意味着你必须要使用标签。Obsidian 社群的领袖更青睐文件夹,我也不会首先启用标签……这样看来,标签似乎只是灵活有余、可靠不足的信息管理方式。其实也不尽然,管见以为,标签有着和文件夹截然不同的使命,作为一种灵活的标记,它既可以在我们收集整理信息时加强认知,此其一;它还可以指示下一步行动,如同是信息管理中的方向标和红绿灯,此其二。
书籍管理毕竟不是瞬息万变的工作,其所涉的标签主要指引文中的第二类,即描述性标签。至于已读、未读、愿望清单等属性,其实可假借 Calibre 中的其他元数据,不必占用标签。
而描述性标签又容易变得零碎,若不想消失在碎片化中,势必要走向附带层级编码的标签。此乃文件夹和传统标签的联姻产物:前半部分相当于一个通讯地址,指示了标签在一个层级系统中的位置,就像门牌号码或者地图的经纬度;后半部分则是标签的具体内容。不用多虑,此方法无需任何特殊工具,你只是在传统标签前面加上一串编码,就像这样:112-物权法。
编码部分实则借鉴了杜威编码,由几位字母和数字组成,在中文环境中非常容易与后半部分区分开。Hum 在早期的文章中已经介绍过这种带层级的标签,相信不必解释杜威编码的技术细节,只需摆出 Hum 当时用过的例子,各位就能看懂层级编码何其简单:
6 知识
6-0 逻辑学
6-1 数学
6-2 物理学 6-2-1 量子物理
惟需澄清,包括 Calibre 在内,部分工具自带了标签组功能,可以把标签排列成文件夹形式,但是这种做法局限太大,一方面需手工排列,另一方面也互不兼容,如果把文件导出到其他地方,原有的层级结构就荡然无存。但只需添加编码,层级位置就会跟着文件走,也不依赖特殊的管理工具,我甚至可以在 Finder(文件管理)、DEVONthink(文件管理)、Taskpaper(任务管理)和 Calibre(书籍管理)中共享同一套标签。诚如 Hum 所言,“不过有层级的标签系统我们也可以、甚至说是应该在前面标数字”。除了低技术和通用——Hum 将这一优点称作“可传输”——朴素的层级编码标签还有诸多好处:
- 方便输入,快速匹配。在支持自动匹配的软件中,例如 Calibre 和 Finder,只需输入编码的前几位,即可匹配的标签,而不用输入完整的标签名(Hum 也解释过这一点)。
- 便于定位,肌肉记忆。macOS 环境中常有支持英文和字母快速定位的地方,假如你眼前有几十上百个标签,只需闭着眼睛按下目标标签的前几位,就能定位该标签。其实即便不带编码,西文标签也有此特性,但是汉字不行,故假借编码确有必要。
- 巩固记忆,培养认知。组织一套标签体系断非目的,它们应当是认识书籍、熟悉书库、搜索图书的工具,每次添加一个标签,就是一次判断书籍并回顾领域体系的训练,这也是虎狼之词“标签必须死”的真正含义。
种种难以言表却易于身教的优点,当然并非 Calibre 的专利,只是在除了标签别无选择之际,我们正好要面对而已。
书籍检索中的层级编码
在书籍管理的语境,层级编码标签还有特殊功能:辅助搜索。如果说在一般的情况下,斟酌关键词全靠经验,那么层级编码因其自索引(self indexd)的特性,帮你探清了一部分道路:你不是闯进一片未开拓的地带,而是寻着即有体系顺藤摸瓜。
在拙作《直达鹄的:在线搜索指津》中,我发现调整搜索关键词主要有三个方向:
放大关键词的范围。如果初次检索时结果太少,或者根本没有结果,那很可能是关键词太过于细致(不考虑选错关键词的情况),此时不妨把关键词调得粗放一些,试试上位概念。 适当缩小关键词范围,尝试下位概念,提高其精度。当你发现搜索结果太多,或者总是掺着如同人工智能生成的万金油答案时,就应该尝试限缩关键词,或者进一步添加更多关键词,从而缩小搜索范围。 等位关键词*变换规则……一种是语义层面的,你可以换一些同义词或近义词……另一种是纯符号层面的,例如从简体中文换到繁体中文,或换到英文等外语,从而找到境外的相关信息。
引文针对在线搜索,故难免要绞尽脑汁无中生有,不过在本地书库中,若组织得当,层级标签本身就可以提供搜索线索。详言之,只要看到编码,你就知道存在一个体系,并且参照编码旋可大致推断出周边地形。例如看到侵权法的标签 117b5-网络侵权责任,我很快就意识到已经进入一个细分领域,而它前面肯定还有好几个平行领域——从 117b1 到 117b4——编码就暗示了相邻信息的存在。
分而论之,依托标签搜索图书,主要有三种模式:
最基础的,划定一个较大的目标范围。假设需找一句格言的出处,此话可能出现在入门教材里,也可能出现在某本法律专著的序言中,还可能出现在某个案例汇编的集子内。当我不确定目的地时,就可以选一个编码靠前的标签,撒下大网。
其次,聚焦几个较小的领域。设想我在办理一个关于合同效力状态的案件,需要寻找关于不同合同状态的论述,在庞大的民商法体系里,