Розширений OCR
Повносторінковий OCR · PDF з можливістю пошуку · Кілька виходів · Пакетна обробка. Прямо у браузері. 100% безкоштовно, конфіденційність захищена.
OCR зчитує текст зі сканованих сторінок та фотографій і перетворює його на справжній, виділений текст. Запустіть його на сканованому контракті або сфотографованій сторінці, і ви отримаєте PDF-файл з можливістю пошуку, який виглядає ідентично, але має текстовий шар під собою, тому працює Ctrl+F, текст можна копіювати, а інші інструменти можуть його видобувати. Вихідні дані також можуть бути простим текстом або структурованим документом. Розпізнавання використовує Tesseract, скомпільований у WebAssembly, і повністю працює у вашому браузері, що незвично для OCR — більшість сервісів вимагають завантаження документа — і підтримує широкий спектр мов, включаючи нелатинські скрипти.
- Завантажити файл — Перетягніть файли в область завантаження або натисніть, щоб переглянути та вибрати файли зі свого пристрою.
- Налаштувати — Повносторінковий OCR · PDF з можливістю пошуку · Кілька виходів · Пакетна обробка
- Завантажити — Натисніть кнопку завантаження, щоб зберегти оброблений файл. Він готовий миттєво!
Часті запитання
Які мови підтримуються?
Широкий набір, що включає англійську, корейську, японську, китайську та основні європейські мови, а також нелатинські скрипти. Вибір правильної мови перед запуском суттєво впливає на точність.
Наскільки це точно?
При чистому скануванні друкованого тексту з роздільною здатністю 300 DPI точність висока. Вона знижується при низькій роздільній здатності, перекосі, тінях, поганій контрастності та рукописному тексті — рукописний текст, зокрема, не розпізнається надійно.
Чи завантажується мій документ на OCR-сервер?
Ні. Розпізнавання працює у вашому браузері через WebAssembly. Файл ніколи не покидає ваш пристрій, що є головною причиною використовувати це замість хмарного OCR-сервісу для конфіденційних документів.
Як отримати найкращі результати?
Скануйте з роздільною здатністю 300 DPI, тримайте сторінку прямо, уникайте тіней та обирайте правильну мову. Вирівнювання та налаштування контрасту перед розпізнаванням також помітно допомагають.
Оптимізація
- Стиснути PDF — Зменшити розмір файлу PDF
- Витягнути зображення — Витягнути вбудовані зображення з PDF
- Аналіз PDF — Детальний аналіз інформації про PDF-документ