Skip to content

文字识别

文字识别,常被称为 OCR,就是把一张写着字的图片重新变回可读的文字。只要你截取屏幕的一部分, TransOne 就会用到它:截图翻译、截图 OCR 和原图翻译都靠它。你框出一块区域后,是识别引擎先读出框里的字,之后才谈得上翻译。

同一时间只有一个识别引擎在工作。要选择它,从菜单栏图标打开偏好设置,进入设置 ▸ 文字识别

有哪些引擎

引擎需要密钥说明
系统(设备端)默认。离线可用,使用 Apple 内置识别器。
OpenAIBase URL、模型、API 密钥。所用模型必须能读图。
百度 OCRAPI Key、Secret Key。
腾讯 OCRSecret ID、Secret Key、地域。密钥在 CAM 访问密钥页
腾讯图片翻译Secret ID、Secret Key、地域、目标语言。此处仅用于识别。
有道 OCRApp Key、App Secret。
Google OCRAPI Key。使用 Google Cloud Vision,需先启用 Vision API。
火山 OCRAccess Key ID、Secret Access Key。

API 密钥是你从某个服务拿到的一段私密代码,用来证明这个请求是你发的。系统引擎不需要密钥,所以大多数人在这里根本不用操心密钥的事。密钥怎么用、存在哪,见翻译引擎

文字识别设置页

系统(设备端)

系统引擎是默认项。它完全在你的 Mac 上运行,所以免费、断网也能用,截下的图片也从不发往任何地方。它有几个选项。

  • 识别模式精确快速。精确读得更仔细,对歪斜或质量差的文字处理得更好;快速出结果更快,对干净、普通的文字足够了。拿不准就选精确,最稳妥。
  • 纠正识别文字:开启语言纠正,用它对这门语言的了解来订正识别结果(比如把一个明显认错的字改过来)。
  • 自动检测语言:关掉它,就改用一个由你勾选的语言列表。这是在告诉识别器该预期哪些语言。

默认状态下,自动检测语言是的,勾选的列表是简体中文、繁体中文、英语、日语。所以如果你扫的是列表之外的语言(比如韩语或法语),识别器可能会漏掉。有两种办法解决:把那门语言加进列表,或者打开自动检测。

提示

如果你扫的一直是那四种默认语言,就保持原样。真正需要时再加语言,因为列表短一些,识别有时会更准。

我该选哪个引擎

先用系统(设备端)。它免费、离线、私密,应付大多数文字都够用。只有当系统引擎对你手上这类素材(比如密密麻麻的截图、少见的字体,或者它不太擅长的语言)老是认错时,才换成云端引擎。云端引擎需要密钥,还会把截下的图片发给那个服务,所以在你真正需要之前没必要用它。

文字去了哪里

识别出来的文字会落进翻译窗口的输入框(原图翻译则是落在浮层上)。截下的图片用完就丢,不会保存。

相关

35c413a