article_image

Obsidian 作为一款广受大家喜爱的笔记工具,然而一直以来都缺少一个剪藏网页的途径。我们往往需要借助第三方的剪藏工具来实现笔记的保存。

现在 Obsidian 开始提供一款名为 Obsidian Web Clipper 的官方剪藏插件,专门用于从网页中提取信息,剪藏的内容会以 Markdown 形式保存下来,并无缝集成到 Obsidian 笔记库中。

🏠 Obsidian Web Clipper - 官网

🔗 Obsidian Clipper - GitHub

功能特点

从目前官方给出的功能说明来看,这款插件有几个特点——

  • 可定制模板:Obsidian Web Clipper 的核心优势之一是其强大的模板功能,允许用户根据网页内容创建自定义模板,自动提取网页的关键信息,如标题、作者、日期等。官网示例里给了“文章、食谱、参考、学术论文”等几种不同的内容作为参考。
  • 智能触发器:通过 URL 模式匹配,用户可以自动应用相应的模板,减少手动干预,提高效率。
  • Markdown 保存:所有剪藏内容均以标准 Markdown 格式保存,确保数据的可移植性和长期可维护性,用户可以在本地离线访问,避免专有格式的限制。这本就是 Obsidian 的长项。
  • 高亮划线和立即编辑:这款插件还支持在网页悬浮窗中进行高亮和提前编辑,将真正需要留存的内容处理好之后,再收藏到知识库中。

Obsidian Web Clipper 目前已经在多个主流浏览器商店中提供,包括 Chrome、Firefox 和 Safari。用户可以通过以下步骤安装扩展:

  • Chrome 浏览器:访问 Chrome Web Store 安装扩展,适用于 Chrome、Brave、Edge 等基于 Chromium 内核的浏览器。
  • Safari 浏览器:前往 Safari Extensions 安装,适用于 macOS、iOS 及 iPadOS。所以手机 Safari 上也可以使用这款插件。

对于需要手动安装、使用其他浏览器的用户,可以分别在 Github Releases 和 官网 了解并下载对应版本。

剪藏结构与模板触发器

官方插件毕竟是官方出品,保留了一些 Obsidian 的独到思路,提供了模板化剪藏方式。Obsidian Web Clipper 的一大特点是其灵活的剪藏结构和模板触发器。

用户可以通过 URL 匹配、正则表达式或网页中的元数据,自动应用适合的模板。无论是从博客、新闻网站,还是其他内容丰富的网页中,用户都能根据具体需求提取关键信息,如文章标题、作者、发布日期等,并将其组织到 Obsidian 笔记中。

此外,该插件提供了多种模板变量,帮助用户自动填充数据,减少手动输入的麻烦。例如,模板可以从网页的 meta 标签、CSS 选择器中提取内容,或者使用预设变量如 {{title}} 和 {{author}} 快速获取网页的基础信息。

为了防止你不知道如何取得这些变量,插件还贴心地提供了当前网页可供使用的 Meta 元素名称,可以在单独的页面上查看。当然,我觉得大部分情况下,原本的配置就已经足够好。

在插件的配置界面,还可以针对性地调整剪藏到哪个 Vault(仓库)、Note location(目录),还有个特别的选项是行为(Behavior),提供了 5 个选项——

  • 创建新笔记
  • 添加到已有笔记的顶部/底部
  • 添加到当天日记的顶部/底部

相当于多提供了一种剪藏的维度,允许连续剪藏到不同的知识库、目录、笔记上,避免内容过于分散或集中。相比其他常见的剪藏工具,Obsidian Web Clipper 显然与 Obsidian 的集成度更高,特别是在自动化处理和模板定制方面表现尤为突出。

剪藏效果的局限性

从目前社区的用户反馈来看,尽管 Obsidian Web Clipper 仍处于 Beta 阶段,但其在大多数情况下运行稳定,偶尔会遇到在复杂网页上内容提取不完整的问题,但随着插件的迭代,这类问题正逐步得到改善。

像这款插件的官网本身就是一个复杂页面,它识别出来的内容显然是不完整的。这个时候这个插件显得有些捉襟见肘,不像一些其他的插件可以选取网页的某一部分进行剪藏。

另外关于 HTML 内容无法无损保存到 Markdown 格式中的问题。这个问题我也曾在 Slack 里讨论过,由于 Obsidian 是一款 Markdown 编辑器,而 HTML 转 Markdown 过程中,必然存在有损转换,难以避免。

经过我测试后

机器阅读:已开放本文前 70% 的正文,剩余内容会员可见。 标准阅读页 · Markdown


author_avatar

#UNTAG Developer