Pretvornik optično prebranih slik v izvlečeno besedilo
Pretvorba prebrane slike v izvlečeno besedilo pretvori slikovne pike v urejatve znakov, tako da lahko preprosto iščete, urejate in shranjujete besede.
Primerjava formatov in tehnične specifikacije
| Specifikacija | IMAGE | TXT |
|---|---|---|
| Vrsta MIME | image/jpeg | text/plain |
| Vrsta | scanned document bitmap photograph | plain text |
| Stiskanje | lossy DCT / lossless Deflate | none |
| Standardna specifikacija | W3C / ISO JPEG / PNG Standard | Unicode Standard / UTF-8 RFC 3629 |
| Glava magičnih bajtov | FF D8 FF (JPEG) or 89 50 4E 47 (PNG) | UTF-8 / ASCII plain stream |
Pregled formata in uporaba
Pretvorba slik dokumentov v navadne besedilne datoteke je pogosta naloga v pisarnah, šolah in arhivih. Ko fotografirate papirni račun ali optično preberete staro knjižno stran, je rezultat statična rastrskata slika. Te slike ni mogoče urejati s standardnim urejevalnikom besedil, njenih besed pa ni mogoče iskati. Zagon optičnega prepoznavanja znakov pretvori te vizualne oblike v strojno berljive nize. Po ekstrakciji se vsebina shrani kot preprosta besedilna datoteka. Ta navadni besedilni format zavzame zelo malo prostora za shranjevanje in se odpre v skoraj vsaki napravi. Arhivarji uporabljajo ta postopek za digitalizacijo zgodovinskih zapisov, s čimer omogočajo iskanje po ključnih besedah. Pisarniški delavci ga uporabljajo za pridobivanje podatkov iz papirnih računov brez ročnega tipkanja.
Tehnične specifikacije in pregled kodekov
Standardna optično prebrana slika JPEG uporablja vrsto MIME image/jpeg, ki se za prihranek prostora zanaša na stiskanje z izgubo diskretne kosinusne transformacije. Datoteka se začne s podpisom magičnega bajta FF D8 FF. Med pretvorbo mehanizem za optično prepoznavanje znakov pregleda mrežo slikovnih pik, da prepozna oblike črk na podlagi geometrije in kontrasta. Izhodna besedilna datoteka uporablja vrsto MIME text/plain brez stiskanja. Vsebuje standardne kodiranja znakov ASCII ali UTF-8 brez režijskih stroškov vsebnika, zaradi česar je nastala datoteka lahka in splošno berljiva.
Združljivost z OS in brskalniki
Izvlečene datoteke TXT delujejo v vseh operacijskih sistemih, vključno s sistemi Windows, macOS, Linux, iOS in Android. Sodobni spletni brskalniki lahko neposredno berejo in prikazujejo besedilne datoteke. Optično prebrane slike JPEG zahtevajo pregledovalnike slik ali specializirane urejevalnike dokumentov, končni besedilni izpis pa zahteva le osnovni urejevalnik besedil, kot sta Notepad ali TextEdit.
💡 Uporabne informacije
Preden zaženete ekstrakcijo besedila, zagotovite, da ima optično prebrana slika visok kontrast in ustrezno osvetlitev, da zmanjšate napake v črkovanju in manjkajoče znake.
Primerjava formatov in tehnične specifikacije
Tipična optično prebrana datoteka JPEG meri približno 2 MB, medtem ko nastala izvlečena datoteka TXT pade na samo 5 KB. Preko standardnega mobilnega omrežja 4G s hitrostjo 15 megabitov na sekundo prenos izvirne slike traja približno eno sekundo, medtem ko se majhna besedilna datoteka prenese takoj v manj kot milisekundi.
Pogosto zastavljena vprašanja
Kako pretvoriti optično prebrano sliko v izvlečeno besedilo brez izgube kakovosti?
Ekstrakcija besedila ne ohranja vizualne kakovosti izvirne slike. Namesto tega podatke slikovnih pik pretvori v berljive znake. Če želite ohraniti visoko natančnost besedila, začnite z jasnim, visokoločljivostnim skeniranjem, da mehanizem za prepoznavanje znakov zlahka loči črke.
Kakšna je razlika med optično prebrano sliko in izvlečenim besedilom?
Optično prebrana slika je vizualna mreža obarvanih slikovnih pik, shranjena v stisnjenem formatu, kot je JPEG. Izvlečeno besedilo je zbirka kodiranih alfanumeričnih znakov, shranjenih v navadni besedilni datoteki brez slik, pisav ali oblikovanja postavitve.