เครื่องมือแปลงภาพที่สแกนเป็นข้อความที่ดึงออกมา

การแปลงภาพที่สแกนเป็นข้อความที่ดึงออกมาจะแปลงพิกเซลรูปภาพให้เป็นอักขระที่แก้ไขได้ เพื่อให้คุณสามารถค้นหา แก้ไข และจัดเก็บคำต่างๆ ได้อย่างง่ายดาย

เลือกหรือลากไฟล์

เลือกหรือวางไฟล์ที่นี่

การแปลงไฟล์แบบส่วนตัว 100% ในเบราว์เซอร์ - ไฟล์จะไม่ rời ออกจากอุปกรณ์ของคุณ

หรือวาง Ctrl+V
การรับประกันความเป็นส่วนตัวแบบไม่มีการส่งผ่านเครือข่าย: อัปโหลด 0 ไบต์ไปยังเซิร์ฟเวอร์ภายนอก การประมวลผลทั้งหมดเกิดขึ้นภายในแซนด์บ็อกซ์ของเบราว์เซอร์ของคุณ

การเปรียบเทียบรูปแบบและข้อกำหนดทางเทคนิค

ข้อกำหนดIMAGETXT
ประเภท MIMEimage/jpegtext/plain
ประเภทscanned document bitmap photographplain text
การบีบอัดlossy DCT / lossless Deflatenone
ข้อกำหนดมาตรฐานW3C / ISO JPEG / PNG StandardUnicode Standard / UTF-8 RFC 3629
ส่วนหัว Magic BytesFF D8 FF (JPEG) or 89 50 4E 47 (PNG)UTF-8 / ASCII plain stream

ภาพรวมรูปแบบและการใช้งาน

การแปลงรูปภาพของเอกสารเป็นไฟล์ข้อความธรรมดาเป็นงานทั่วไปสำหรับสำนักงาน โรงเรียน และหอสมุด เมื่อคุณถ่ายภาพใบเสร็จกระดาษหรือสแกนหน้าหนังสือเก่า ผลลัพธ์ที่ได้คือภาพบิตแมปแบบคงที่ ภาพนี้ไม่สามารถแก้ไขด้วยโปรแกรมประมวลผลคำมาตรฐานได้ และไม่สามารถค้นหาคำในภาพได้ การเรียกใช้การจดจำอักขระด้วยแสงจะแปลงรูปร่างภาพเหล่านั้นให้อยู่ในรูปของสตริงที่เครื่องอ่านได้ หลังจากการดึงข้อมูล เนื้อหาจะถูกบันทึกเป็นไฟล์ข้อความธรรมดา รูปแบบข้อความธรรมดาUนี้ใช้พื้นที่จัดเก็บน้อยมากและเปิดได้บนเกือบทุกอุปกรณ์ นักเก็บบันทึกใช้กระบวนการนี้เพื่อแปลงบันทึกประวัติศาสตร์ให้อยู่ในรูปแบบดิจิทัล ทำให้สามารถค้นหาได้ด้วยคีย์เวิร์ด พนักงานสำนักงานใช้กระบวนการนี้เพื่อดึงข้อมูลออกจากใบแจ้งหนี้กระดาษโดยไม่ต้องพิมพ์ทุกอย่างด้วยมือ

ข้อมูลทางเทคนิคและรายละเอียดตัวแปลงสัญญาณ (Codec)

ภาพสแกน JPEG มาตรฐานใช้ประเภท MIME เป็น image/jpeg ซึ่งอาศัยการบีบอัดแบบสูญเสียข้อมูล discrete cosine transform เพื่อประหยัดพื้นที่ ไฟล์เริ่มต้นด้วยลายเซ็นไบต์เวทมนตร์ FF D8 FF ระหว่างการแปลง เครื่องมือจดจำอักขระด้วยแสงจะสแกนตารางพิกเซลเพื่อระบุรูปร่างของตัวอักษรตามเรขาคณิตและความตัดกัน ไฟล์ข้อความผลลัพธ์ใช้ประเภท MIME เป็น text/plain โดยไม่มีการบีบอัด ซึ่งประกอบด้วยการเข้ารหัสอักขระมาตรฐาน ASCII หรือ UTF-8 โดยไม่มีค่าใช้จ่ายด้านคอนเทนเนอร์ ทำให้ไฟล์ผลลัพธ์มีน้ำหนักเบาและสามารถอ่านได้ทั่วโลก

ความเข้ากันได้ของระบบปฏิบัติการและเบราว์เซอร์

ไฟล์ TXT ที่ดึงออกมาใช้งานได้กับทุกระบบปฏิบัติการ รวมถึง Windows, macOS, Linux, iOS และ Android เว็บเบราว์เซอร์สมัยใหม่สามารถอ่านและแสดงไฟล์ข้อความได้โดยตรง ภาพ JPEG ที่สแกนจำเป็นต้องมีโปรแกรมดูรูปภาพหรือตัวแก้ไขเอกสารเฉพาะทาง แต่ผลลัพธ์ข้อความขั้นสุดท้ายต้องการเพียงโปรแกรมแก้ไขข้อความพื้นฐานเช่น Notepad หรือ TextEdit

💡 ข้อมูลที่เป็นประโยชน์

ตรวจสอบให้แน่ใจว่าภาพที่สแกนของคุณมีความคมชัดสูงและมีแสงสว่างที่เหมาะสมก่อนที่จะรันการดึงข้อมูลข้อความ เพื่อลดข้อผิดพลาดในการสะกดคำและอักขระที่หายไป

การเปรียบเทียบรูปแบบและข้อกำหนดทางเทคนิค

ไฟล์ JPEG ที่สแกนทั่วไปมีขนาดประมาณ 2 เมกะไบต์ ในขณะที่ไฟล์ TXT ที่ดึงออกมาจะลดลงเหลือเพียง 5 กิโลไบต์ ผ่านเครือข่ายมือถือ 4G มาตรฐานที่ถ่ายโอนที่ความเร็ว 15 เมกบิตต่อวินาที ภาพต้นฉบับใช้เวลาดาวน์โหลดประมาณหนึ่งวินาที ในขณะที่ไฟล์ข้อความขนาดเล็กจะดาวน์โหลดเสร็จทันทีในเวลาน้อยกว่าหนึ่งมิลลิวินาที

คำถามที่พบบ่อย

คุณจะแปลงภาพที่สแกนเป็นข้อความที่ดึงออกมาโดยไม่สูญเสียคุณภาพได้อย่างไร

การดึงข้อความไม่ได้รักษาคุณภาพภาพของภาพต้นฉบับ แต่จะแปลงข้อมูลพิกเซลให้เป็นอักขระที่อ่านได้แทน เพื่อรักษาความแม่นยำของข้อความให้สูง ให้เริ่มต้นด้วยการสแกนความละเอียดสูงที่ชัดเจน เพื่อให้เครื่องมือจดจำอักขระสามารถแยกแยะตัวอักษรได้อย่างง่ายดาย

ความแตกต่างระหว่างภาพที่สแกนและข้อความที่ดึงออกมาคืออะไร

ภาพที่สแกนคือตารางภาพของพิกเซลสีที่จัดเก็บในรูปแบบที่บีบอัด เช่น JPEG ข้อความที่ดึงออกมาคือชุดของอักขระตัวAอักษรและตัวเลขที่เข้ารหัสซึ่งจัดเก็บไว้ในไฟล์ข้อความธรรมดาโดยไม่มีภาพ แบบอักษร หรือการจัดรูปแบบเลย์เอาต์