图片转文字

● 100% 在浏览器中完成:不上传任何文件

Loading…

把图片转换成可选中、可搜索的文字。检测会找出每一行文本,识别则使用你选择的语言包进行读取,每一行都附带置信度分数,方便你判断哪些需要复核。图片始终不会离开你的浏览器。

使用方法

  1. 拖入图片或 PDF,文字检测会立即开始。
  2. 选择语言包(仅需下载一次,8–17 MB),然后点击“识别文字”。
  3. 复制识别结果,或下载 .txt / .json。PDF 会从头到尾完整读取。

常见问题

我的文件会被上传吗?
不会。模型和所有处理都在你的浏览器中、你自己的设备上运行。你可以自行验证:打开浏览器的开发者工具,切换到“网络”面板,然后处理一个文件——你不会看到任何上传。首次访问之后,大多数工具还可以完全离线使用。
支持哪些语言?
共 106 种语言,涵盖拉丁、西里尔、阿拉伯、天城文、中日韩、希腊、泰文、泰米尔文和泰卢固文等文字体系。孟加拉语是目前唯一的主要缺口,因为还没有对应的 v5 模型,语言选择器中会如实说明,而不会含糊带过。
识别准确率如何?
在清晰的文档文字上,实测字符错误率低于 2%,并且每一行都带有置信度分数,方便你判断哪些需要复核。手写体和低分辨率照片的识别效果会明显下降。
能识别扫描版 PDF 吗?
可以。电子版 PDF 会直接读取其自带的文本层,字符和位置都完全准确。扫描页面则会经过检测和识别流程,图文混排的文档两者都会用到。

相关工具