OCR متقدم

OCR لكامل الصفحة · PDF قابل للبحث · مخرجات متعددة · معالجة مجمّعة. مباشرة في متصفحك. مجاني 100%، خصوصية محمية.

يقوم OCR بقراءة النصوص في الصفحات الممسوحة ضوئيًا والصور ويحولها إلى نص حقيقي قابل للتحديد. شغله على عقد ممسوح ضوئيًا أو صفحة مصورة وستستعيد ملف PDF قابل للبحث يبدو متطابقًا ولكنه يحتوي على طبقة نصية تحته، بحيث يعمل Ctrl+F، ويمكن نسخ النص، ويمكن للأدوات الأخرى استخراجه. يمكن أن يكون الإخراج أيضًا نصًا عاديًا أو مستندًا منظمًا. يستخدم التعرف برنامج Tesseract المجمع إلى WebAssembly ويعمل بالكامل في متصفحك، وهو أمر غير معتاد لـ OCR — فمعظم الخدمات تتطلب تحميل المستند — ويدعم مجموعة واسعة من اللغات بما في ذلك النصوص غير اللاتينية.

  1. رفع الملف — اسحب ملفاتك وأفلتها في منطقة التحميل، أو انقر للتصفح واختيار الملفات من جهازك.
  2. الإعدادات — OCR لكامل الصفحة · PDF قابل للبحث · مخرجات متعددة · معالجة مجمّعة
  3. تحميل — انقر على زر التنزيل لحفظ ملفك المعالج. إنه جاهز على الفور!

الأسئلة الشائعة

ما هي اللغات المدعومة؟

مجموعة واسعة تشمل الإنجليزية، الكورية، اليابانية، الصينية، واللغات الأوروبية الرئيسية، بالإضافة إلى النصوص غير اللاتينية. يؤدي اختيار اللغة الصحيحة قبل التشغيل إلى إحداث فرق كبير في الدقة.

ما مدى دقته؟

في مسح ضوئي نظيف بنسبة 300 DPI لنص مطبوع، تكون الدقة عالية. تنخفض الدقة مع انخفاض الدقة، والانحراف، والظلال، وضعف التباين، والكتابة اليدوية — على وجه الخصوص، لا يتم التعرف على الكتابة اليدوية بشكل موثوق.

هل يتم تحميل مستندي إلى خادم OCR؟

لا. يعمل التعرف في متصفحك عبر WebAssembly. لا يغادر الملف جهازك أبدًا، وهو السبب الرئيسي لاستخدام هذا بدلاً من خدمة OCR السحابية للمستندات الحساسة.

كيف أحصل على أفضل النتائج؟

قم بالمسح الضوئي بدقة 300 DPI، حافظ على استقامة الصفحة، تجنب الظلال، واختر اللغة الصحيحة. يساعد أيضًا تعديل الانحراف والتباين قبل التعرف بشكل ملحوظ.

تحسين