ต้องการดึงตัวอักษรออกจากรูปภาพใช่ไหม ไม่ว่าจะเป็นใบเสร็จที่สแกนไว้ ภาพถ่ายไวต์บอร์ด สกรีนช็อตของเอกสาร หรือรูปป้ายต่าง ๆ OCR (Optical Character Recognition หรือการรู้จำอักขระด้วยแสง) จะเปลี่ยนพิกเซลของภาพให้เป็นข้อความจริงที่คุณคัดลอก แก้ไข และค้นหาได้ คู่มือนี้อธิบายวิธีใช้เครื่องมือ รูปภาพเป็นข้อความ (OCR) ฟรีบนเว็บไซต์นี้ การจดจำข้อความทำงานบนเซิร์ฟเวอร์ของเรา ไฟล์ของคุณจะถูกส่งผ่านการเชื่อมต่อที่เข้ารหัส และถูกลบทันทีที่ดึงข้อความเสร็จ
OCR คืออะไร
OCR ย่อมาจาก Optical Character Recognition หรือการรู้จำอักขระด้วยแสง เป็นเทคโนโลยีที่วิเคราะห์รูปภาพและระบุรูปทรงของตัวอักษร ตัวเลข และเครื่องหมายวรรคตอน เพื่อสร้างข้อความที่เครื่องอ่านได้
เอนจิน OCR สมัยใหม่ใช้โครงข่ายประสาทเทียมที่ฝึกด้วยตัวอักษรพิมพ์และลายมือหลายล้านตัว จึงรู้จำข้อความได้ในฟอนต์ ขนาด ภาษา และสภาพภาพที่หลากหลาย แม้ภาพจะเอียงเล็กน้อยหรือเบลอบ้าง
OCR คือเทคโนโลยีที่ทำให้:
- ธนาคารแปลงเช็คและเอกสารยืนยันตัวตนเป็นดิจิทัลได้
- Google Search ทำดัชนีข้อความที่อยู่ในรูปภาพได้
- บริการไปรษณีย์อ่านที่อยู่ที่เขียนด้วยลายมือบนซองจดหมายได้
- นักจดหมายเหตุทำให้หนังสือที่สแกนหลายล้านเล่มค้นหาได้
เทคโนโลยีเดียวกันนี้ใช้ได้ฟรีที่นี่
วิธีดึงข้อความจากรูปภาพ ทีละขั้นตอน
เครื่องมือ รูปภาพเป็นข้อความ (OCR) รัน Tesseract OCR บนเซิร์ฟเวอร์ของเรา รูปภาพของคุณจะถูกอัปโหลดผ่านการเชื่อมต่อ HTTPS ที่เข้ารหัส จากนั้นดึงข้อความออกมา แล้วลบไฟล์ที่อัปโหลดออกจากเซิร์ฟเวอร์
ขั้นตอนที่ 1: เปิดเครื่องมือ รูปภาพเป็นข้อความ (OCR)
ไปที่ want2convert.com/image-to-text คุณจะเห็นพื้นที่อัปโหลดแบบเรียบง่ายและตัวเลือกภาษา
ขั้นตอนที่ 2: อัปโหลดรูปภาพ
ลากรูปภาพมาวางในพื้นที่อัปโหลด หรือคลิกเพื่อเลือกจากอุปกรณ์ของคุณ รองรับรูปแบบ JPG, PNG, TIFF, BMP, WebP และ PDF ขนาดสูงสุด 50 MB สำหรับเอกสารที่สแกน ให้ใช้ความละเอียดการสแกนสูงสุดที่มี: 300 DPI ขึ้นไปให้ผลดีที่สุด
ขั้นตอนที่ 3: เลือกภาษา (ถ้าจำเป็น)
โดยค่าเริ่มต้น เอนจินจะรู้จำภาษาอังกฤษ เครื่องมือนี้ยังรองรับภาษาสวาฮีลี (คิสวาฮีลี) ฝรั่งเศส และอาหรับ ให้เลือกภาษาของข้อความในรูปจากเมนูแบบเลื่อนลงก่อนดึงข้อความ การใช้โมเดลภาษาที่ถูกต้องช่วยเพิ่มความแม่นยำได้มากสำหรับตัวอักษรที่มีเครื่องหมายกำกับและรูปแบบตัวอักษรเฉพาะของแต่ละภาษา ขณะนี้ยังไม่รองรับภาษาอื่น
ขั้นตอนที่ 4: คลิก “ดึงข้อความ”
คลิกปุ่ม ไฟล์ของคุณจะถูกส่งไปยังเซิร์ฟเวอร์ของเรา ซึ่งจะขยายและแปลงเป็นโทนสีเทาเพื่อให้การรู้จำดีขึ้น แล้วให้ Tesseract อ่าน การประมวลผลมักใช้เวลาไม่กี่วินาที ขึ้นอยู่กับขนาดของภาพและความหนาแน่นของข้อความ คำขอจะหมดเวลาหลังประมาณสองนาที
ขั้นตอนที่ 5: คัดลอกหรือดาวน์โหลดผลลัพธ์
ข้อความที่ดึงออกมาจะแสดงในกล่องข้อความ คุณสามารถ:
- คัดลอกไปยังคลิปบอร์ด — วางลงใน Word, Google Docs หรือโปรแกรมแก้ไขข้อความใดก็ได้ได้ทันที
- ดาวน์โหลด .txt — บันทึกผลลัพธ์เป็นไฟล์
.txt
รูปต้นฉบับแบบไหนเหมาะกับ OCR
ความแม่นยำของ OCR ขึ้นอยู่กับคุณภาพของรูปภาพที่นำเข้ามาก สิ่งที่สร้างความแตกต่างได้มากที่สุดมีดังนี้:
ความละเอียด: ข้อความต้องมีพิกเซลมากพอจึงจะอ่านออก ภาพถ่ายเอกสารจากมือถือที่ถ่ายในแสงดีและระยะที่เหมาะสม (30–50 ซม.) มักใช้ได้ดี ความละเอียดต่ำสุดที่ใช้งานได้จริงสำหรับตัวอักษรเล็กที่ชัดเจนอยู่ที่ราว 150–200 DPI ส่วน 300 DPI เป็นมาตรฐานของ OCR สำหรับการสแกนเก็บถาวร
คอนทราสต์: ข้อความสีเข้มบนพื้นสว่างให้สัญญาณที่ชัดที่สุดแก่เอนจิน หมึกที่จาง ข้อความสีเทาอ่อนบนกระดาษขาว หรือข้อความสีบนพื้นหลังที่มีลวดลายจะลดความแม่นยำ
ความคมชัด: ภาพเบลอ ไม่ว่าจากกล้องสั่นหรือปัญหาการโฟกัส เป็นสาเหตุเดี่ยวที่ทำให้ OCR ผิดพลาดมากที่สุด ควรวางมือถือบนพื้นผิวที่มั่นคงเมื่อถ่ายเอกสาร โหมดมาโครของมือถือใช้ได้ดีกับเอกสารที่ตัวอักษรเล็ก
การวางแนว: ข้อความที่เอียงหรือหมุนมากจะลดความแม่นยำ เอนจิน OCR รับมือกับความเอียงเล็กน้อย (ไม่กี่องศา) ได้ แต่หน้ากระดาษที่ถ่ายในมุมชันจะให้ผลแย่กว่า หากจำเป็น ให้ใช้เครื่องมือ หมุนรูปภาพ หมุนรูปให้ถูกด้านก่อน
สัญญาณรบกวนและเงา: รอยพับ เงาที่พาดบนหน้ากระดาษ และพื้นผิวของพื้นหลังจะลดความแม่นยำ ควรถ่ายเอกสารโดยวางราบบนโต๊ะสีอ่อนและมีแสงสม่ำเสมอ
ความแม่นยำ: สิ่งที่ OCR ทำได้และทำไม่ได้
OCR แม่นยำมากกับเอกสารพิมพ์ที่สะอาดและคอนทราสต์สูง มักได้ความแม่นยำของตัวอักษร 99% ขึ้นไปเมื่อต้นฉบับดี อย่างไรก็ตาม เทคโนโลยีนี้มีข้อจำกัดจริงที่ควรเข้าใจ:
| ประเภทต้นฉบับ | ความแม่นยำที่คาดไว้ | |------------|------------------| | เอกสารพิมพ์ที่สแกนสะอาด (300 DPI) | 98–99%+ | | ภาพถ่ายมือถือที่คมชัดของข้อความพิมพ์ | 90–97% | | งานพิมพ์ที่จางหรือคอนทราสต์ต่ำ | 70–85% | | ลายมือ (เป็นระเบียบ สม่ำเสมอ) | 60–80% | | ลายมือ (ตัวเขียน เขียนไม่สม่ำเสมอ) | 40–65% | | ฟอนต์ตกแต่งมากหรือโลโก้ | 30–60% | | ข้อความในภาพที่มีสัญญาณรบกวนหรือพื้นหลังรกมาก | 50–75% |
สำหรับข้อความพิมพ์ในสภาพที่ดี คาดหวังผลลัพธ์ที่เกือบสมบูรณ์แบบได้ แต่ควรตรวจทานผลลัพธ์เสมอ เพราะตัวอักษรผิดเพียงตัวเดียวในตัวเลขหรือชื่ออาจส่งผลจริงจังได้
การใช้งานทั่วไปของการแปลงรูปภาพเป็นข้อความ
เอกสารที่สแกนและไฟล์ PDF
สำนักงานยังต้องจัดการกับกระดาษกองโต เมื่อคุณได้รับสัญญา แบบฟอร์ม หรือจดหมายที่สแกนมาเป็น PDF หรือรูปภาพ OCR จะแปลงเป็นเอกสารที่ค้นหาและแก้ไขได้ หลังดึงข้อความแล้ว ให้วางลงใน Word หรือ Google Docs เพื่อแก้ไข หรือบันทึกเป็นไฟล์ที่ค้นหาได้ด้วย Ctrl+F
ใบเสร็จและใบแจ้งหนี้
การถ่ายรูปใบเสร็จเป็นวิธีที่นิยมในการติดตามค่าใช้จ่าย OCR จะดึงรายการ ยอดรวม และชื่อร้านค้าออกมา เพื่อให้คุณวางลงในสเปรดชีตหรือรายงานค่าใช้จ่ายได้ทันทีโดยไม่ต้องพิมพ์ใหม่
นามบัตร
ภาพถ่ายนามบัตรด่วน ๆ จากมือถือเมื่อผ่าน OCR จะได้ชื่อ ตำแหน่ง เบอร์โทร อีเมล และบริษัทของผู้ติดต่อ พร้อมคัดลอกไปไว้ในแอปรายชื่อผู้ติดต่อของคุณ
สกรีนช็อตบทความและหน้าเว็บ
หากคุณต้องการอ้างอิงจากสกรีนช็อตหรือคัดลอกข้อความจาก PDF ที่เป็นภาพ (หนังสือที่สแกน หรือ PDF ที่เลือกข้อความไม่ได้) OCR จะดึงออกมาเป็นข้อความจริงที่คุณใช้งานได้
ภาพถ่ายไวต์บอร์ด
หลังประชุม ภาพถ่ายบันทึกบนไวต์บอร์ดมักนอนนิ่งอยู่ในแกลเลอรีโดยไม่มีใครนำไปใช้ OCR จะเปลี่ยนภาพเหล่านั้นเป็นไฟล์ข้อความหรือบันทึกที่ค้นหาได้
การแปลงหนังสือและเอกสารเก็บถาวรเป็นดิจิทัล
นักวิจัยและนักสืบประวัติวงศ์ตระกูลที่สแกนหนังสือเก่า หนังสือพิมพ์ และบันทึกทางประวัติศาสตร์ ใช้ OCR เพื่อทำให้คลังเอกสารเหล่านั้นค้นหาได้ Tesseract ซึ่งเป็นเอนจินโอเพนซอร์สที่ใช้ที่นี่ ถูกใช้อย่างแพร่หลายในโครงการแปลงเอกสารเก็บถาวรเป็นดิจิทัล
ขั้นตอนการแปลภาษา
ดึงข้อความจากรูปภาพก่อน แล้วค่อยวางลงในเครื่องมือแปลภาษา วิธีนี้เร็วกว่าการพิมพ์ข้อความจากภาพถ่ายเอกสาร เมนู หรือป้ายภาษาต่างประเทศใหม่ด้วยมือมาก
OCR กับการคัดลอกและวาง: ควรใช้แบบไหนเมื่อไร
หากคุณทำงานกับ PDF ดิจิทัลที่มีเลเยอร์ข้อความ การกด Ctrl+A + Ctrl+C (เลือกทั้งหมดแล้วคัดลอก) เร็วและแม่นยำกว่า OCR ให้ใช้ OCR เมื่อ:
- PDF เป็นภาพสแกน (ไม่มีเลเยอร์ข้อความ)
- ต้นฉบับเป็นภาพถ่ายหรือสกรีนช็อต
- เอกสารไม่อนุญาตให้เลือกข้อความ (PDF ที่ถูกล็อก แม้ว่าคุณอาจอยากจะปลดล็อกก่อนด้วย)
- ข้อความอยู่บนเอกสารจริง ป้าย หรือไวต์บอร์ด
คำถามที่พบบ่อย
เครื่องมือ OCR ฟรีจริงหรือไม่
ใช่ ฟรีทั้งหมด ไม่ต้องมีบัญชี ไม่ต้องสมัครสมาชิก และไม่มีลายน้ำบนผลลัพธ์
รูปภาพของฉันปลอดภัยไหม
รูปภาพหรือ PDF ของคุณจะถูกส่งไปยังเซิร์ฟเวอร์ของเราผ่านการเชื่อมต่อที่เข้ารหัส (HTTPS) ประมวลผลที่นั่นด้วย Tesseract OCR และลบทันทีที่ดึงข้อความเสร็จ เราไม่เก็บสำเนาไว้และไม่ต้องมีบัญชี เนื่องจากไฟล์ถูกประมวลผลบนเซิร์ฟเวอร์ จึงควรหลีกเลี่ยงการอัปโหลดเอกสารที่คุณไม่สบายใจจะส่งผ่านอินเทอร์เน็ต
รองรับภาษาอะไรบ้าง
ภาษาอังกฤษเป็นค่าเริ่มต้น คุณยังเลือกภาษาสวาฮีลี (คิสวาฮีลี) ฝรั่งเศส หรืออาหรับได้จากตัวเลือกภาษา ขณะนี้ยังไม่รองรับภาษาอื่น
แม่นยำแค่ไหน
สำหรับข้อความพิมพ์ที่สะอาดและมีความละเอียดเพียงพอ ความแม่นยำมักสูงมาก สำหรับลายมือหรือภาพคุณภาพต่ำ ความแม่นยำจะต่ำกว่า ควรตรวจทานผลลัพธ์เสมอสำหรับเอกสารสำคัญ
อ่านลายมือได้ไหม
OCR รู้จำลายมือได้อย่างจำกัด ทำงานได้ดีที่สุดกับข้อความพิมพ์ และบันทึกที่เขียนด้วยมืออาจให้ผลไม่ดี โดยเฉพาะลายมือตัวเขียน
ขนาดรูปภาพสูงสุดเท่าไร
จำกัดการอัปโหลดที่ 50 MB และคำขอจะหมดเวลาหลังประมาณสองนาที รูปภาพขนาดใหญ่มากอาจช้า การย่อให้กว้าง 2000–3000 พิกเซลด้วยเครื่องมือ ปรับขนาดรูปภาพ ก่อนทำ OCR มักช่วยให้เร็วขึ้นโดยไม่ทำให้ความแม่นยำลดลง
ดึงข้อความจาก PDF ได้ไหม
ได้ คุณอัปโหลด PDF ได้โดยตรง ระบบจะเรนเดอร์หน้าต่าง ๆ แล้วอ่านทีละหน้า หาก PDF มีขนาดใหญ่หรือต้องการควบคุมมากขึ้น คุณยังบันทึกหน้าเป็น JPG หรือ PNG ก่อนด้วยเครื่องมือ PDF เป็น JPG แล้วรัน OCR กับรูปภาพได้
ทำไมบางตัวอักษรจึงผิด
ข้อผิดพลาดของ OCR มักมาจากความละเอียดต่ำ ภาพเบลอ คอนทราสต์ต่ำ หรือฟอนต์ที่ไม่ธรรมดา ลองปรับปรุงคุณภาพของรูปภาพต้นฉบับแล้วรันใหม่ สำหรับข้อผิดพลาดที่เกิดซ้ำ (เช่น l ถูกอ่านเป็น 1) ให้แก้ไขผลลัพธ์ด้วยมือหลังดึงข้อความ
เครื่องมือที่เกี่ยวข้อง
- ปรับขนาดรูปภาพ — ขยายรูปภาพขนาดเล็กก่อนทำ OCR เพื่อเพิ่มความแม่นยำ
- หมุนรูปภาพ — ปรับรูปที่เอียงให้ตรงก่อนทำ OCR
- PDF เป็น JPG — แปลงหน้า PDF ที่สแกนเป็นรูปภาพเพื่อทำ OCR
- ลดขนาดรูปภาพ — ลดขนาดรูปภาพโดยไม่เสียความละเอียดที่ OCR ต้องการ
- JPG เป็น PNG — แปลงเป็น PNG เพื่อคุณภาพไร้การสูญเสียก่อนทำ OCR กับเอกสารตัวอักษรเล็ก
- ครอบตัดรูปภาพ — แยกส่วนที่มีข้อความของรูปภาพออกมาก่อนรัน OCR
ลองใช้ฟรี ไม่ต้องสมัครสมาชิก
เครื่องมือส่วนใหญ่ทำงานในเบราว์เซอร์ ไฟล์ของคุณจึงอยู่บนอุปกรณ์ของคุณ ส่วนเครื่องมือบางตัวจะอัปโหลดไฟล์ไปยังเซิร์ฟเวอร์ของเราและลบทิ้งหลังประมวลผลเสร็จ