article_image

屏幕内容 OCR,或者简单的说是“识别屏幕上的文字,再把它复制下来。”对我来说算是刚需。在很长的一段时间,我每年花费不到100人民币订阅一款工具来专门做这件事。算是我极少数长期订阅的工具。直到发现 DeepL 免费版已经把这件事做得更好。

所谓更好,主要指的是识别速度/准确、多语言识别(混合识别精准度)、直接翻译这 3 个方面。在我的使用情境下,这些地方的体验更加重要。

省流版:在 DeepL 的设置里打开 Capture text on screen 选项,然后直接用快捷键 ⇧Shift - ⌘Command - 2 来测试一下。自己试比看文字更快直到效果。

速度和准确度

首先是速度和准确度。这两者是 OCR 功能的核心。

两个放在一起说是因为缺了哪一个,这功能都不能用。快但不准,好像搞笑;准但是慢,用得憋屈。但在 OCR 这个领域,小工具无法控制准确度和速度。它们用的是国内大科技公司提供的 API,随后在上面搭一些小功能。我订阅了几年的服务即是如此,速度和 DeepL 完全无法相提并论。DeepL 是否是自研的 OCR 技术尚不清楚,但速度和免费无限使用这两点已经足够有竞争力(如果它以后学坏了开始次数收费之类的,我会用脚投票哈)。

多语言识别

多语言识别是 OCR 的基本功。DeepL 做的相当不错,但有进步空间。

在这个点,DeepL 因为支持的语言太多,所以它希望你在识别多语言时首选以下输入语言。比如日语英文的混合识别,就把输入语言选成日语。这样成功率会非常理想。如果不这样,它有点 Panic 😅

直接翻译

大多数时候,我 OCR 就是为了翻译。所以 DeepL 这个翻译工具搭一个屏幕

机器阅读:已开放本文前 70% 的正文,剩余内容会员可见。 标准阅读页 · Markdown