article_image

对照翻译的原理是修改网页源代码并引入机器翻译,在阅读排版简单的文章时,不容易出错,往往让初次使用的人大为惊叹,但是在诸多边缘情况组成的长尾分布中,有着一系列难以事先准备的问题,会导致翻译或排版效果不佳。本期再介绍一类瑕疵:数学公式翻译错误。

即便是较为初等的数学公式,往往也有上标、下标等特殊元素,故不适合写成单行的代码,这意味着无法用行内代码或代码块来容纳公式,通常和大段文字混在一块儿,最终翻译时也就被一起翻译了(多数翻译引擎还是比较机械的,只会避开代码框这类特殊元素,但较难识别数学公式)。而一旦遇上公式中的字母,不少翻译引擎都会穿凿附会,强行试着将这些字母翻译为中文,最终得到“罗马字母的第XX个字母”“第XX个英文字母”这种一股服务器烧焦味儿的机翻结果,比解冻时间没控制好的牛排还生硬。

如果使用现成的插件,此时只好去开发者那边提 issue,等待救援。但本站所提出的元祖方案则不然,既然本质是修改网页源码,那么继续在源码上手动调整,理应可以复原被误翻译的数学公式。方法不难,且触类旁通,值得一学。和前几期类似,还是先通过元素检查器(Inspector)获取源码:以 Safari 为例,按下快捷键 ⌥Option-⌘Command-I,打开检查器,找到出错的那部分,点击右键,随后先后选中“Edit”和“HTML”,旋即可按下 ⌘Command-A 选中源码,并复制出来。不熟悉网页结构的读者也可以复制整片代码。

接着,随手拉一个文本编辑器过来,诸如 BBEdit 和 CotEditor 这类支持正则表达式的最好,不会用的话找系统自带文本编辑器也行。新建一个文本文件,将方才复制的源码投入其中,粗粗

机器阅读:已开放本文前 70% 的正文,剩余内容会员可见。 标准阅读页 · Markdown


author_avatar

法律顾问,前律师, macOS/iOS 自动化业余玩家。有效即合法,无效的优雅有罪。