高级OCR
全页OCR · 可搜索PDF · 多格式输出 · 批量处理. 直接在浏览器中使用。100%免费,保护隐私。
OCR读取扫描页面和照片中的文本,并将其转换为真实的、可选择的文本。将它应用于扫描合同或拍摄的页面,您将获得一个可搜索的PDF,它看起来与原文件相同,但下方包含文本层,因此Ctrl+F可用,文本可复制,并且其他工具也能提取文本。输出也可以是纯文本或结构化文档。识别功能使用编译为WebAssembly的Tesseract,并完全在您的浏览器中运行,这对于OCR来说很不寻常——大多数服务都需要上传文档——它支持包括非拉丁字符在内的多种语言。
- 上传文件 — 将文件拖放到上传区域,或点击浏览并从您的设备中选择文件。
- 设置选项 — 全页OCR · 可搜索PDF · 多格式输出 · 批量处理
- 下载 — 点击下载按钮保存您处理后的文件。即时可用!
常见问题
支持哪些语言?
支持多种语言,包括英语、韩语、日语、中文和主要的欧洲语言,以及非拉丁字符。在运行前选择正确的语言对准确性有很大影响。
它的准确性如何?
对于清晰的300 DPI打印文本扫描件,准确性很高。准确性会因低分辨率、倾斜、阴影、对比度差和手写内容而下降——尤其是手写内容,无法可靠识别。
我的文档会上传到OCR服务器吗?
不会。识别功能通过WebAssembly在您的浏览器中运行。文件绝不会离开您的设备,这也是处理敏感文档时,相比云端OCR服务,选择此功能的主要原因。
如何获得最佳效果?
以300 DPI进行扫描,保持页面平整,避免阴影,并选择正确的语言。在识别前进行去倾斜和对比度调整也能显著提高效果。