批量图像转文本

● 100%在你的浏览器里:没有上传任何内容

Loading…

OCR一次扫描数百张图片:收据、扫描件、截图、存档。每张画面都产生自己的.txt情感,ZIP也承载着每一句台词、位置和自信的合JSON,随时准备被剧本吞噬。

使用方法

  1. 发布一张图片或 PDF。短信检测立即启动。
  2. 选择你的语言包(下载一次,8–17 MB),然后点击阅读文本。
  3. 复制台词,或者下载.txt/.json。PDF内容从头到尾阅读。

常见问题

一批文件最多能处理多少文件?
每次运行最多可达500个文件或2 GB输入,作为散装文件或单个 ZIP丢弃。物品在你的设备上一次处理一个,没有上传任何东西,进度条会显示每个物品的预计到达时间。大任务:分成两个投放。
我能得到什么回报?
其中一个 ZIP:每个处理过的文件,名字和单文件下载完全一样,加上_report.txt和_report.json列出每个输入及其发生了什么,包括失败的部分及其原因。取消的批次仍然会下载目前已完成的物品,报告中也说明了这一点。
我的文件会上传吗?
不。模型和所有处理都运行在你自己的设备上的浏览器中。你可以自己验证:打开浏览器 DevTools,关注网络标签,处理文件:没有上传。第一次访问后,大多数工具也能完全离线使用。
支持哪些语言?
涵盖拉丁字母、西里尔字母、阿拉伯字母、天城文、 CJK文、希腊文、泰语、泰米尔文和泰卢固语的106种语言。孟加拉语是唯一的主要空白,因为目前还没有针对孟加拉语的V5模型,选人是直接说的,而不是猜测。
它有多准确?
在干净的文档文本中,测量的字符错误率低于2%,每行都有置信度分数,方便你查看哪些行。手写和低分辨率照片会更难看。
它能读取扫描的PDF吗?
是的。数字PDF是从自己的文本层读取的,字符精确且位置精确。扫描页面会经过检测和识别,混合文档则同时使用两者。

相关工具