مبدل‌های OCR و اسکن‌شده

استخراج و تبدیل کاراکترهای نوری از تصاویر اسکن‌شده و PDFها.

تبدیل‌های محبوب OCR و اسکن‌شده

اسناد اسکن‌شده و OCR: PDFهای قابل جستجو و لایه‌های متنی

تشخیص نوری کاراکتر (OCR)، استخراج متن و قابلیت جستجوی اسناد اسکن‌شده.

🔒۱۰۰٪ خصوصی

فایل‌های شما به‌طور کامل در مرورگر وب شما و با استفاده از HTML5 Canvas و WebAssembly پردازش می‌شوند. حتی یک بایت داده نیز از دستگاه شما خارج نمی‌شود.

سرعت آنی

از صف‌های آپلود و دانلود صرف‌نظر کنید. تبدیل‌ها به‌صورت محلی و با سرعت کامل سخت‌افزار سیستم و بدون محدودیت‌های سرور انجام می‌شوند.

📐استانداردهای جهانی

مطابق با مشخصات رسمی ISO، W3C و IETF برای تضمین سازگاری خروجی در سیستم‌عامل‌های مدرن.

مقایسه فرمت‌ها و مشخصات فنی

فرمت خروجینوع MIMEمشخصاتنوع
PDF اسکن‌شدهapplication/pdfISO-32000-2فایل PDF اسکن‌شده به صورت رستر
IMG تصویر اسکن‌شدهimage/jpegW3C-PNGتصویر سند اسکن‌شده
TXT متن سادهtext/plainRFC-4180-CSVمتن ساده بدون قالب‌بندی
DOCX سند Wordapplication/vnd.openxmlformats-officedocument.wordprocessingml.documentISO-IEC-29500سند OpenXML مایکروسافت ورد
HOCR فایل hOCR HTMLtext/htmlHOCR-SPEC-12نشانه‌گذاری مکانی hOCR
PNG تصویرimage/pngW3C-PNGگرافیک شبکه‌ای قابل حمل
JPG تصویر JPEGimage/jpegW3C-PNGفرمت استاندارد گروه کارشناسان عکاسی
PDF سندapplication/pdfISO-32000-2فرمت قابل حمل اسناد

مشخصات فنی و تحلیل کدک

⚙️

فایل‌های PDF قابل جستجو چگونه کار می‌کنند

یک سند اسکن‌شده در واقع تنها تصویری از یک کاغذ است. موتور OCR اشکال حروف را تشخیص داده و یک لایه متنی نامرئی و قابل انتخاب را دقیقاً بر روی تصویر درج می‌کند. هنگامی که متنی را در فایل PDF برجسته کرده یا جستجو می‌کنید، در حقیقت در حال انتخاب آن لایه متنی نامرئی هستید.

📜

وضوح ۳۰۰ DPI؛ نقطه ایده‌آل برای اسکن کردن

اسکن کردن اسناد با وضوح ۱۵۰ DPI باعث ایجاد حروف شکسته و دقت پایین در OCR می‌شود. اسکن با وضوح ۶۰۰ DPI اندازه فایل را چهار برابر می‌کند بدون اینکه بهبود چشمگیری در تشخیص متن ایجاد نماید. وضوح ۳۰۰ DPI نقطه ایده‌آل جهانی برای دستیابی به دقت بالای OCR و حجم فشرده فایل‌ها است.

💡اطلاعات مفید

صفر بایت به سرورهای خارجی آپلود می‌شود. تمام پردازش‌ها به صورت محلی در سندباکس مرورگر شما انجام شد.