Skannatun kuvan muuntaminen tekstiksi (OCR)

Skannatun kuvan muuntaminen tekstiksi muuttaa kuvapisteet muokattaviksi merkeiksi, jotta voit helposti etsiä, muokata ja tallentaa sanoja.

Valitse tai vedä tiedostoja

Valitse tai pudota tiedostot tähän

100 % yksityinen selaimen sisäinen muunnos - tiedostot eivät poistu laitteeltasi

tai liitä Ctrl+V
Tietosuojatakuu: 0 % verkkosiirtoa 0 tavua ladattu ulkoisille palvelimille. Kaikki käsittely tapahtui paikallisesti selaimen hiekkalaatikossa.

Muotojen vertailu ja tekniset tiedot

MääritysIMAGETXT
MIME-tyyppiimage/jpegtext/plain
Tyyppiscanned document bitmap photographplain text
Pakkauslossy DCT / lossless Deflatenone
StandardimääritysW3C / ISO JPEG / PNG StandardUnicode Standard / UTF-8 RFC 3629
Tiedostotunniste (Magic Bytes)FF D8 FF (JPEG) or 89 50 4E 47 (PNG)UTF-8 / ASCII plain stream

Muodon yleiskatsaus ja käyttökohteet

Kuvien muuntaminen selkotiedostoiksi on yleinen tehtävä toimistoissa, kouluissa ja arkistoissa. Kun otat valokuvan paperikuitista tai skannaat vanhan kirjan sivun, tuloksena on staattinen bittikarttakuva. Tätä kuvaa ei voi muokata tekstinkäsittelyohjelmalla eikä sen sanoista voi hakea tietoa. Optinen merkkien tunnistus (OCR) muuntaa nämä visuaaliset muodot koneluettaviksi merkkijonoiksi. Purkamisen jälkeen sisältö tallennetaan yksinkertaiseksi tekstitiedostoksi. Tämä pelkkä tekstitiedostomuoto vie hyvin vähän tallennustilaa ja avautuu lähes millä tahansa laitteella. Arkistonhoitajat käyttävät tätä prosessia historiallisten asiakirjojen digitointiin, mikä tekee niistä hakusanalla haettavia. Toimistotyöntekijät käyttävät sitä tietojen poimimiseen paperilaskuista ilman manuaalista kirjoittamista.

Tekniset tiedot ja koodekkien erittely

Tavallinen skannattu JPEG-kuva käyttää image/jpeg-MIME-tyyppiä, joka hyödyntää häviöllistä diskreettiä kosinimuunnosittaista pakkausta tilan säästämiseksi. Tiedosto alkaa tavuallekirjoituksella FF D8 FF. Muunnoksen aikana optisen merkkien tunnistuksen moottori skannaa pikseliruudukkoa tunnistaakseen kirjainten muodot geometrian ja kontrastin perusteella. Tuloksena oleva tekstitiedosto käyttää text/plain-MIME-tyyppiä ilman pakkausta. Se sisältää standardeja ASCII- tai UTF-8-merkistöjä ilman säilön lisäkuormaa, mikä tekee tulostiedostosta kevyen ja yleisesti luettavan.

Käyttöjärjestelmien ja selaimien yhteensopivuus

Puretut TXT-tiedostot toimivat kaikissa käyttöjärjestelmissä, kuten Windowsissa, macOS:ssä, Linuxissa, iOS:ssä ja Androidissa. Nykyaikaiset verkkoselaimet voivat lukea ja näyttää tekstitiedostoja suoraan. Skannatut JPEG-kuvat vaativat kuvankatseluohjelmia tai erikoistuneita asiakirjaohjelmia, mutta lopullinen tekstituloste vaatii vain perustoimittajan, kuten Muistion (Notepad) tai TextEditin.

💡 Hyödyllistä tietoa

Varmista ennen tekstin poimintaa, että skannatussa kuvassa on korkea kontrasti ja oikea valaistus, jotta kirjoitusvirheet ja puuttuvat merkit jäävät mahdollisimman vähäisiksi.

Muotojen vertailu ja tekniset tiedot

Tyypillinen skannattu JPEG-tiedosto on kooltaan noin 2 megatavua, kun taas tuloksena syntyvä purettu TXT-tiedosto kutistuu vain 5 kilotavuun. Tavallisessa 15 megabittiä sekunnissa siirtävässä mobiiliverkossa alkuperäisen kuvan lataaminen kestää noin sekunnin, kun taas pieni tekstitiedosto latautuu välittömästi alle millisekunnissa.

Usein kysytyt kysymykset

Miten skannattu kuva muunnetaan tekstiksi ilman laadun heikkenemistä?

Tekstin poiminta ei säilytä alkuperäisen kuvan visuaalista laatua. Sen sijaan se kääntää pikselitiedot luettaviksi merkeiksi. Jotta tekstin tarkkuus pysyy korkeana, aloita selkeällä, korkearesoluutioisella skannauksella, jotta merkkien tunnistusmoottori pystyy erottamaan kirjaimet toisistaan helposti.

Mitä eroa on skannatulla kuvalla ja poimitulla tekstillä?

Skannattu kuva on väripikseleistä koostuva visuaalinen ruudukko, joka on tallennettu pakattuun muotoon, kuten JPEG-tiedostoon. Poimittu teksti on kokoelma koodattuja aakkosnumeerisia merkkejä, jotka on tallennettu pelkkään tekstitiedostoon ilman kuvia, fontteja tai asettelun muotoilua.