Skannatun kuvan muuntaminen tekstiksi (OCR)
Skannatun kuvan muuntaminen tekstiksi muuttaa kuvapisteet muokattaviksi merkeiksi, jotta voit helposti etsiä, muokata ja tallentaa sanoja.
Muotojen vertailu ja tekniset tiedot
| Määritys | IMAGE | TXT |
|---|---|---|
| MIME-tyyppi | image/jpeg | text/plain |
| Tyyppi | scanned document bitmap photograph | plain text |
| Pakkaus | lossy DCT / lossless Deflate | none |
| Standardimääritys | W3C / ISO JPEG / PNG Standard | Unicode Standard / UTF-8 RFC 3629 |
| Tiedostotunniste (Magic Bytes) | FF D8 FF (JPEG) or 89 50 4E 47 (PNG) | UTF-8 / ASCII plain stream |
Muodon yleiskatsaus ja käyttökohteet
Kuvien muuntaminen selkotiedostoiksi on yleinen tehtävä toimistoissa, kouluissa ja arkistoissa. Kun otat valokuvan paperikuitista tai skannaat vanhan kirjan sivun, tuloksena on staattinen bittikarttakuva. Tätä kuvaa ei voi muokata tekstinkäsittelyohjelmalla eikä sen sanoista voi hakea tietoa. Optinen merkkien tunnistus (OCR) muuntaa nämä visuaaliset muodot koneluettaviksi merkkijonoiksi. Purkamisen jälkeen sisältö tallennetaan yksinkertaiseksi tekstitiedostoksi. Tämä pelkkä tekstitiedostomuoto vie hyvin vähän tallennustilaa ja avautuu lähes millä tahansa laitteella. Arkistonhoitajat käyttävät tätä prosessia historiallisten asiakirjojen digitointiin, mikä tekee niistä hakusanalla haettavia. Toimistotyöntekijät käyttävät sitä tietojen poimimiseen paperilaskuista ilman manuaalista kirjoittamista.
Tekniset tiedot ja koodekkien erittely
Tavallinen skannattu JPEG-kuva käyttää image/jpeg-MIME-tyyppiä, joka hyödyntää häviöllistä diskreettiä kosinimuunnosittaista pakkausta tilan säästämiseksi. Tiedosto alkaa tavuallekirjoituksella FF D8 FF. Muunnoksen aikana optisen merkkien tunnistuksen moottori skannaa pikseliruudukkoa tunnistaakseen kirjainten muodot geometrian ja kontrastin perusteella. Tuloksena oleva tekstitiedosto käyttää text/plain-MIME-tyyppiä ilman pakkausta. Se sisältää standardeja ASCII- tai UTF-8-merkistöjä ilman säilön lisäkuormaa, mikä tekee tulostiedostosta kevyen ja yleisesti luettavan.
Käyttöjärjestelmien ja selaimien yhteensopivuus
Puretut TXT-tiedostot toimivat kaikissa käyttöjärjestelmissä, kuten Windowsissa, macOS:ssä, Linuxissa, iOS:ssä ja Androidissa. Nykyaikaiset verkkoselaimet voivat lukea ja näyttää tekstitiedostoja suoraan. Skannatut JPEG-kuvat vaativat kuvankatseluohjelmia tai erikoistuneita asiakirjaohjelmia, mutta lopullinen tekstituloste vaatii vain perustoimittajan, kuten Muistion (Notepad) tai TextEditin.
💡 Hyödyllistä tietoa
Varmista ennen tekstin poimintaa, että skannatussa kuvassa on korkea kontrasti ja oikea valaistus, jotta kirjoitusvirheet ja puuttuvat merkit jäävät mahdollisimman vähäisiksi.
Muotojen vertailu ja tekniset tiedot
Tyypillinen skannattu JPEG-tiedosto on kooltaan noin 2 megatavua, kun taas tuloksena syntyvä purettu TXT-tiedosto kutistuu vain 5 kilotavuun. Tavallisessa 15 megabittiä sekunnissa siirtävässä mobiiliverkossa alkuperäisen kuvan lataaminen kestää noin sekunnin, kun taas pieni tekstitiedosto latautuu välittömästi alle millisekunnissa.
Usein kysytyt kysymykset
Miten skannattu kuva muunnetaan tekstiksi ilman laadun heikkenemistä?
Tekstin poiminta ei säilytä alkuperäisen kuvan visuaalista laatua. Sen sijaan se kääntää pikselitiedot luettaviksi merkeiksi. Jotta tekstin tarkkuus pysyy korkeana, aloita selkeällä, korkearesoluutioisella skannauksella, jotta merkkien tunnistusmoottori pystyy erottamaan kirjaimet toisistaan helposti.
Mitä eroa on skannatulla kuvalla ja poimitulla tekstillä?
Skannattu kuva on väripikseleistä koostuva visuaalinen ruudukko, joka on tallennettu pakattuun muotoon, kuten JPEG-tiedostoon. Poimittu teksti on kokoelma koodattuja aakkosnumeerisia merkkejä, jotka on tallennettu pelkkään tekstitiedostoon ilman kuvia, fontteja tai asettelun muotoilua.