Vodnik po optični prepoznavi znakov (OCR) in iskalnem PDF
Izvleček besedila, matrike zanesljivosti znakov in prepoznavanje slik.
Vaše datoteke se obdelujejo izključno v vašem spletnem brskalniku z uporabo tehnologij HTML5 Canvas in WebAssembly. Noben podatek nikoli ne zapusti vaše naprave.
Preskočite čakalne vrste za nalaganje in prenašanje. Pretvorbe potekajo lokalno s polno strojno hitrostjo naprave brez strežniških omejitev.
Skladno z uradnimi specifikacijami ISO, W3C in IETF, kar zagotavlja združljivost izhodnih datotek v sodobnih operacijskih sistemih.
Primerjava formatov in tehnične specifikacije
| Izhodni format | Vrsta MIME | Specifikacija | Vrsta |
|---|---|---|---|
| PDF Skeniran | application/pdf | ISO-32000-2 | Rastrsko skeniran dokument PDF |
| IMG Skenirana slika | image/jpeg | W3C-PNG | Slika skeniranega dokumenta |
| TXT Navadno besedilo | text/plain | RFC-4180-CSV | Neoblikovano navadno besedilo |
| DOCX Wordov dokument | application/vnd.openxmlformats-officedocument.wordprocessingml.document | ISO-IEC-29500 | Microsoft Word OpenXML dokument |
| HOCR HTML | text/html | HOCR-SPEC-12 | Prostorska označevalna koda hOCR |
| PNG Slika | image/png | W3C-PNG | Prenosna omrežna grafika |
| JPG Slika JPEG | image/jpeg | W3C-PNG | Format skupine Joint Photographic Experts Group |
| PDF PDF | application/pdf | ISO-32000-2 | Prenosni dokumentni format (PDF) |
Tehnične specifikacije in pregled kodekov
Nevidne besedilne plasti v dokumentih PDF
Tehnologija OCR ustvari neviden iskalni sloj besedila točno nad optično prebrano sliko strani, kar omogoča iskanje in kopiranje.
0 bajtov naloženih na zunanje strežnike. Vsa obdelava je potekala lokalno v varnem območju vašega brskalnika.