Розширений OCR

Повносторінковий OCR · PDF з можливістю пошуку · Кілька виходів · Пакетна обробка. Прямо у браузері. 100% безкоштовно, конфіденційність захищена.

OCR зчитує текст зі сканованих сторінок та фотографій і перетворює його на справжній, виділений текст. Запустіть його на сканованому контракті або сфотографованій сторінці, і ви отримаєте PDF-файл з можливістю пошуку, який виглядає ідентично, але має текстовий шар під собою, тому працює Ctrl+F, текст можна копіювати, а інші інструменти можуть його видобувати. Вихідні дані також можуть бути простим текстом або структурованим документом. Розпізнавання використовує Tesseract, скомпільований у WebAssembly, і повністю працює у вашому браузері, що незвично для OCR — більшість сервісів вимагають завантаження документа — і підтримує широкий спектр мов, включаючи нелатинські скрипти.

  1. Завантажити файл — Перетягніть файли в область завантаження або натисніть, щоб переглянути та вибрати файли зі свого пристрою.
  2. Налаштувати — Повносторінковий OCR · PDF з можливістю пошуку · Кілька виходів · Пакетна обробка
  3. Завантажити — Натисніть кнопку завантаження, щоб зберегти оброблений файл. Він готовий миттєво!

Часті запитання

Які мови підтримуються?

Широкий набір, що включає англійську, корейську, японську, китайську та основні європейські мови, а також нелатинські скрипти. Вибір правильної мови перед запуском суттєво впливає на точність.

Наскільки це точно?

При чистому скануванні друкованого тексту з роздільною здатністю 300 DPI точність висока. Вона знижується при низькій роздільній здатності, перекосі, тінях, поганій контрастності та рукописному тексті — рукописний текст, зокрема, не розпізнається надійно.

Чи завантажується мій документ на OCR-сервер?

Ні. Розпізнавання працює у вашому браузері через WebAssembly. Файл ніколи не покидає ваш пристрій, що є головною причиною використовувати це замість хмарного OCR-сервісу для конфіденційних документів.

Як отримати найкращі результати?

Скануйте з роздільною здатністю 300 DPI, тримайте сторінку прямо, уникайте тіней та обирайте правильну мову. Вирівнювання та налаштування контрасту перед розпізнаванням також помітно допомагають.

Оптимізація