Beolvasott kép szöveggé alakító konverter
A beolvasott kép szöveggé alakítása a képpontokat szerkeszthető karakterekké fordítja, így a szavak könnyen kereshetők, szerkeszthetők és tárolhatók lesznek.
Formátum-összehasonlítás és műszaki specifikációk
| Specifikáció | IMAGE | TXT |
|---|---|---|
| MIME-típus | image/jpeg | text/plain |
| Típus | scanned document bitmap photograph | plain text |
| Tömörítés | lossy DCT / lossless Deflate | none |
| Szabványos specifikáció | W3C / ISO JPEG / PNG Standard | Unicode Standard / UTF-8 RFC 3629 |
| Varázsbájtok fejléc (Magic Bytes) | FF D8 FF (JPEG) or 89 50 4E 47 (PNG) | UTF-8 / ASCII plain stream |
Formátum áttekintése és alkalmazási területei
A dokumentumokról készült fényképek sima szöveges fájlokká történő konvertálása gyakori feladat irodákban, iskolákban és levéltárakban. Ha lefényképez egy papíralapú nyugtát vagy beolvas egy régi könyvoldalt, az eredmény egy statikus bittérképes kép. Ezt a képet nem lehet szerkeszteni egy standard szövegszerkesztővel, és a szavai sem kereshetők. Az optikai karakterfelismerés futtatása ezeket a vizuális alakzatokat gépileg olvasható karakterláncokká alakítja át. A kinyerés után a tartalom egyszerű szöveges fájlként kerül mentésre. Ez a sima szöveges formátum nagyon kevés tárhelyet foglal el, és szinte bármilyen eszközön megnyitható. Az archiválási szakemberek ezt a folyamatot használják a történelmi feljegyzések digitalizálására, kulcsszavak alapján kereshetővé téve azokat. Az irodai dolgozók pedig az adatok papíralapú számlákból történő kinyerésére használják anélkül, hogy mindent kézzel kellene beírniuk.
Műszaki specifikációk és kodek áttekintés
Egy standard JPEG beolvasott kép image/jpeg MIME-típust használ, amely a helytakarékosság érdekében veszteséges diszkrét koszinusz-transzformációs tömörítésre támaszkodik. A fájl az FF D8 FF magic byte aláírással kezdődik. A konverzió során egy optikai karakterfelismerő motor átvizsgálja a képpontrácsot, hogy a geometria és a kontraszt alapján azonosítsa a betűformákat. A kimeneti szövegfájl text/plain MIME-típust használ, tömörítés nélkül. Standard ASCII vagy UTF-8 karakterkódolást tartalmaz, nulla tároló-fejléccel, így a kapott fájl pehelykönnyű és univerzálisan olvasható.
OS és böngésző kompatibilitás
A kinyert TXT fájlok minden operációs rendszeren működnek, beleértve a Windowst, a macOS-t, a Linuxot, az iOS-t és az Androidot. A modern webböngészők közvetlenül képesek olvasni és megjeleníteni a szövegfájlok tartalmát. A beolvasott JPEG képek megjelenítéséhez képmegjelenítők vagy speciális dokumentumszerkesztők szükségesek, de a végső szövegkimenethez elegendő egy alapszintű szövegszerkesztő, például a Jegyzettömb (Notepad) vagy a TextEdit.
💡 Hasznos információk
A helyesírási hibák és a hiányzó karakterek csökkentése érdekében a szövegfelismerés futtatása előtt győződjön meg arról, hogy a beolvasott kép magas kontraszttal és megfelelő megvilágítással rendelkezik.
Formátum-összehasonlítás és műszaki specifikációk
Egy tipikus beolvasott JPEG fájl mérete körülbelül 2 MB, míg az eredményül kapott kinyert TXT fájl mindössze 5 KB-ra csökken. Egy másodpercenként 15 megabites sebességű átvitelt biztosító szabványos 4G mobilhálózaton az eredeti kép letöltése körülbelül egy másodpercet vesz igénybe, míg a parányi szövegfájl kevesebb mint egy ezredmásodperc alatt azonnal letöltődik.
Gyakran Ismételt Kérdések
Hogyan lehet a beolvasott képet kinyert szöveggé alakítani a minőség romlása nélkül?
A szövegkinyerés nem őrzi meg az eredeti kép vizuális minőségét. Ehelyett a képpontadatokat olvasható karakterekké fordítja át. A szöveg pontosságának megőrzése érdekében tiszta, nagy felbontású beolvasással kell kezdeni, hogy a karakterfelismerő motor könnyen megkülönböztesse egymástól a betűket.
Mi a különbség a beolvasott kép és a kinyert szöveg között?
A beolvasott kép a színezett képpontok vizuális rácsa, amelyet tömörített formátumban, például JPEG-ben tárolnak. A kinyert szöveg kódolt alfanumerikus karakterek gyűjteménye, amelyet sima szöveges fájlban tárolnak, képek, betűtípusok vagy elrendezési stílusok nélkül.