Расширенный OCR
Полностраничный OCR · PDF с возможностью поиска · Несколько форматов вывода · Пакетная обработка. Прямо в браузере. 100% бесплатно, конфиденциальность защищена.
OCR считывает текст на отсканированных страницах и фотографиях, превращая его в настоящий, выделяемый текст. Примените его к отсканированному контракту или сфотографированной странице, и вы получите PDF с возможностью поиска, который выглядит идентично, но имеет текстовый слой, так что Ctrl+F работает, текст можно копировать, а другие инструменты могут его извлекать. Вывод также может быть в виде обычного текста или структурированного документа. Распознавание использует Tesseract, скомпилированный в WebAssembly, и полностью выполняется в вашем браузере, что необычно для OCR — большинство сервисов требуют загрузки документа — и поддерживает широкий спектр языков, включая нелатинские шрифты.
- Загрузить файл — Перетащите файлы в область загрузки или нажмите, чтобы выбрать файлы с вашего устройства.
- Настроить — Полностраничный OCR · PDF с возможностью поиска · Несколько форматов вывода · Пакетная обработка
- Скачать — Нажмите кнопку загрузки, чтобы сохранить обработанный файл. Он готов мгновенно!
Часто задаваемые вопросы
Какие языки поддерживаются?
Широкий набор, включающий английский, корейский, японский, китайский и основные европейские языки, а также нелатинские шрифты. Выбор правильного языка перед запуском значительно влияет на точность.
Насколько он точен?
При чистом сканировании печатного текста с разрешением 300 DPI точность высока. Она снижается при низком разрешении, перекосе, тенях, плохой контрастности и рукописном тексте — рукописный текст, в частности, распознается ненадежно.
Загружается ли мой документ на сервер OCR?
Нет. Распознавание выполняется в вашем браузере через WebAssembly. Файл никогда не покидает ваше устройство, что является главной причиной использовать этот сервис вместо облачного OCR для конфиденциальных документов.
Как получить наилучшие результаты?
Сканируйте с разрешением 300 DPI, держите страницу прямо, избегайте теней и выбирайте правильный язык. Коррекция перекоса и настройка контрастности перед распознаванием также заметно помогают.
Оптимизация
- Сжать PDF — Уменьшить размер файла PDF
- Извлечь изображения — Извлечь встроенные изображения из PDF
- Анализ PDF — Подробно проанализировать информацию о PDF-документе