วิธีใช้งานเครื่องมือแกะข้อความ (OCR)
OCR คืออะไร? หลักการทำงาน
OCR (Optical Character Recognition) คือเทคโนโลยีการรู้จำตัวอักษรด้วยแสง ซึ่งแปลงรูปภาพที่มีข้อความเป็นข้อมูลดิจิทัลที่แก้ไข คัดลอก และค้นหาได้ เครื่องมือนี้ใช้ Tesseract.js ซึ่งเป็น OCR Engine โอเพนซอร์สที่ดีที่สุดตัวหนึ่งของโลก พัฒนาต้นแบบโดย HP Labs และปัจจุบันดูแลโดย Google
🔒 ความเป็นส่วนตัว: รูปภาพของคุณไม่ถูกส่งออกไปที่ใดทั้งสิ้น ทุกอย่างประมวลผลในเบราว์เซอร์ด้วย WebAssembly ข้อมูลภาษา (Language Data) จะถูก cache ไว้ในเบราว์เซอร์หลังโหลดครั้งแรก
เทคนิคถ่ายรูปให้แกะข้อความได้แม่นยำ
ข้อจำกัดของ OCR
| ข้อจำกัด | รายละเอียด |
|---|---|
| ลายมือ | OCR ถูกออกแบบมาสำหรับตัวพิมพ์ ลายมือเขียนจะแกะได้ยากและไม่แม่นยำ |
| ภาพเบลอ / ความละเอียดต่ำ | รูปที่ไม่ชัดหรือตัวอักษรเล็กมากจะทำให้ผลลัพธ์ผิดพลาด |
| ข้อความบนพื้นหลังซับซ้อน | ตัวอักษรบนพื้นหลังรูปภาพ, ลายน้ำ, หรือสีที่คล้ายกันจะแกะได้ยาก |
| ข้อความแนวตั้ง / หมุน | ข้อความที่หมุนมากกว่า 15 องศาอาจแกะไม่ถูกต้อง |
| ฟอนต์ตกแต่ง | ฟอนต์ที่มีลวดลายมาก เช่น ฟอนต์คัดลายมือหรือฟอนต์อาร์ต อาจแกะได้ไม่แม่นยำ |
ทำไม OCR ภาษาไทยยากกว่าภาษาอังกฤษมาก
ถ้าเคยลองแกะข้อความภาษาอังกฤษแล้วได้ผลเกือบเป๊ะ แต่พอเปลี่ยนเป็นไทยกลับเพี้ยนไปหมด นั่นไม่ใช่เพราะเครื่องมือไม่ดี แต่เพราะตัวเขียนภาษาไทยยากกว่าจริง ๆ อยู่สามเรื่อง
1. ตัวอักษรไทยวางซ้อนกันสี่ชั้น
ภาษาอังกฤษเรียงตัวอักษรไปทางเดียวคือแนวนอน แต่ภาษาไทยวางซ้อนกันในแนวตั้งได้ถึง 4 ชั้น — สระบนบน (ไม้โท) สระบน (สระอิ) พยัญชนะ และสระล่าง (สระอุ) คำว่า “ปุ่ม” มีทั้งสระล่างและวรรณยุกต์บน ส่วน “ที่” มีสระอิกับไม้เอกซ้อนกันสองชั้นเหนือพยัญชนะ
OCR ต้องแยกให้ออกว่าจุดหมึกที่อยู่เหนือตัวอักษรคือวรรณยุกต์ สระ หรือแค่รอยเปื้อนบนกระดาษ ซึ่งถ้ารูปความละเอียดต่ำ เครื่องหมายเล็ก ๆ พวกนี้จะหายไปก่อนเพื่อนเสมอ ผลคือได้ข้อความที่พยัญชนะถูกแต่วรรณยุกต์หาย — “ที่” กลายเป็น “ท”
2. ไม่มีช่องว่างระหว่างคำ
OCR ภาษาอังกฤษใช้ช่องว่างเป็นตัวช่วยตัดสินขอบเขตของคำ แล้วเอาคำที่ได้ไปเทียบกับพจนานุกรมเพื่อแก้ตัวอักษรที่อ่านพลาด แต่ภาษาไทยเขียนติดกันหมด ตัวช่วยนี้จึงหายไป ตัวอักษรที่อ่านพลาดหนึ่งตัวเลยไม่ถูกจับได้ และลามไปทำให้ตัดคำผิดต่อกันเป็นแถบ
3. พยัญชนะหลายคู่หน้าตาต่างกันนิดเดียว
ภาษาไทยมีพยัญชนะ 44 ตัวในพื้นที่รูปทรงที่จำกัด หลายคู่ต่างกันแค่หัวเข้าหัวออก หรือขาสั้นขายาว ซึ่งเป็นรายละเอียดที่หายไปทันทีเมื่อภาพเบลอ นี่คือคู่ที่ควรไล่ตรวจก่อนเสมอหลังแกะข้อความเสร็จ
| คู่ที่มักสลับกัน | ต่างกันตรงไหน | เจอบ่อยในคำ |
|---|---|---|
| ก · ถ · ภ | หัวและขาด้านขวา | กัน / ถัง / ภาพ |
| ด · ค · ต | ยอดบนซ้ายและหัว | ดี / คี / ตี |
| บ · ป · ษ | ขาที่ยื่นขึ้นด้านขวา | บ้าน / ป้าน / ษ |
| ข · ช | หัวเข้าหรือหัวออก | ขาย / ชาย |
| ผ · ฝ | เส้นเล็กบนขาขวา | ผัด / ฝัด |
| พ · ฬ | ขาที่สามและหาง | พาน / ฬ |
| ฎ · ฏ | หัวมนหรือหัวหยัก | กฎ / ปฏิบัติ |
| เ · แ | ขีดเดียวหรือสองขีด | เก่ง / แก่ง |
💡 เทคนิคตรวจงานเร็ว ๆ: หลังแกะข้อความเสร็จ ให้กวาดตาหาคำที่อ่านแล้วไม่เป็นภาษาก่อน ส่วนใหญ่จะเป็นคู่ในตารางนี้สลับกัน หรือวรรณยุกต์หายไป ถ้ามีข้อความยาวมาก ลองเอาไปวางในหน้า นับคำ & ตัวอักษรไทย แล้วดูรายการคำที่ตัดได้ — คำที่ตัดออกมาแล้วดูแปลกคือจุดที่ควรไปตรวจ
ค่าความเชื่อมั่นบอกอะไร และควรเชื่อที่เท่าไร
นอกจากตัวข้อความ ระบบยังให้ค่าความเชื่อมั่นมาด้วย ซึ่งเป็นคะแนน 0–100 ที่บอกว่าตัว OCR เองมั่นใจแค่ไหนกับสิ่งที่อ่านได้ ไม่ใช่การรับประกันว่าถูก แต่ใช้ตัดสินได้ว่าควรตรวจงานละเอียดแค่ไหน
| คะแนนเฉลี่ย | ป้ายที่แสดง | ควรทำอะไรต่อ |
|---|---|---|
| 90–100 | แม่นยำมาก | อ่านผ่านรอบเดียวพอ ตรวจเฉพาะตัวเลขและชื่อเฉพาะ |
| 75–89 | แม่นยำดี | ใช้ได้ แต่ควรกวาดตาหาวรรณยุกต์ที่หาย |
| 50–74 | ปานกลาง | ต้องตรวจทั้งหมด อาจคุ้มกว่าถ้าถ่ายรูปใหม่ |
| ต่ำกว่า 50 | ต่ำ | อย่าเพิ่งใช้ ถ่ายใหม่ให้ชัดขึ้นแล้วลองอีกครั้ง |
ระบบยังนับแยกเป็นรายคำด้วยว่ามีกี่คำที่มั่นใจสูง (ตั้งแต่ 80 ขึ้นไป) กี่คำปานกลาง (50–79) และกี่คำที่มั่นใจต่ำ (ต่ำกว่า 50) ตัวเลขที่ควรดูจริง ๆ คือจำนวนคำที่มั่นใจต่ำ ไม่ใช่ค่าเฉลี่ย เพราะเอกสารที่มีคำถูกต้อง 95 คำและผิดยับ 5 คำ จะได้ค่าเฉลี่ยสูงจนดูน่าไว้ใจ ทั้งที่ 5 คำนั้นอาจเป็นตัวเลขเงินหรือชื่อคน
ถ่ายหรือสแกนที่ความละเอียดเท่าไรถึงพอ
ปัจจัยเดียวที่มีผลมากที่สุดต่อความแม่นยำคือ ตัวอักษรในรูปสูงกี่พิกเซล ไม่ใช่ขนาดไฟล์หรือความละเอียดรวมของภาพ
- ตัวอักษรควรสูงอย่างน้อย 20 พิกเซล สำหรับภาษาอังกฤษ และควรเผื่อขึ้นเป็น 30–40 พิกเซลสำหรับภาษาไทย เพราะต้องเหลือที่ให้วรรณยุกต์กับสระที่ซ้อนอยู่ด้านบนล่างด้วย
- สแกนเอกสารที่ 300 dpi เป็นค่ามาตรฐานของงาน OCR ต่ำกว่านี้ตัวอักษรเริ่มแตก สูงกว่านี้ไฟล์ใหญ่ขึ้นโดยความแม่นยำไม่ได้เพิ่มตาม
- ถ่ายด้วยมือถือให้เต็มกรอบ — ถ่ายเอกสาร A4 เต็มเฟรมด้วยกล้อง 12 ล้านพิกเซล จะได้ตัวอักษรขนาดพอเหลือเฟือ ปัญหาจริงมักอยู่ที่การถ่ายห่างเกินไปแล้วค่อยมาครอป
- เอกสารสีขาวดำอย่าถ่ายเป็นโหมดขาวดำจัด — ปล่อยให้เป็นภาพสีปกติจะดีกว่า เพราะการบีบเป็นสองสีมักกินวรรณยุกต์บาง ๆ หายไปก่อน
ที่มาของข้อมูล:
เกณฑ์ค่าความเชื่อมั่น (90 / 75 / 50) และการนับคำแยกกลุ่ม (80 / 50)
อ่านจาก /assets/ocr.js ซึ่งเป็นโมดูลเดียวกับที่เครื่องมือด้านบนใช้
ตรวจเมื่อ 16 สิงหาคม 2569 ·
ตัวอ่านข้อความเป็น Tesseract.js ซึ่งเป็นโอเพนซอร์ส ทำงานด้วย WebAssembly ในเบราว์เซอร์ ·
เกณฑ์ความสูงตัวอักษรและ 300 dpi เป็นแนวปฏิบัติทั่วไปของงาน OCR ไม่ใช่ค่าตายตัว —
ผลจริงขึ้นกับฟอนต์ คุณภาพกระดาษ และแสงตอนถ่าย
คู่พยัญชนะในตารางรวบรวมจากรูปแบบความผิดพลาดที่พบบ่อย
ไม่ใช่รายการที่ครบถ้วนทุกกรณี
คำถามที่พบบ่อย (FAQ)
รูปภาพถูกอัปโหลดขึ้นเซิร์ฟเวอร์หรือไม่
ไม่ ทุกอย่างประมวลผลในเบราว์เซอร์ของคุณเอง รูปภาพไม่ถูกส่งออกไปที่ใดทั้งสิ้น ใช้ Tesseract.js ที่ทำงานฝั่ง Client-Side 100% ปลอดภัยสำหรับเอกสารสำคัญและรูปส่วนตัว
รองรับภาษาอะไรบ้าง
รองรับภาษาไทยและภาษาอังกฤษ สามารถเลือกแกะเฉพาะภาษาเดียวหรือแกะทั้งสองภาษาพร้อมกันได้ การเลือกภาษาให้ตรงกับข้อความในรูปจะช่วยให้ผลลัพธ์แม่นยำขึ้น
ทำไมแกะข้อความไทยได้ไม่แม่นยำ
ความแม่นยำขึ้นอยู่กับคุณภาพของรูปภาพ ถ่ายรูปให้ชัด แสงสว่างเพียงพอ ตัวอักษรไม่เอียงมาก และพื้นหลังไม่รกจะช่วยได้มาก ภาษาไทยที่เป็นลายมือจะแกะได้ยากกว่าตัวพิมพ์
ค่าความเชื่อมั่นควรอยู่ที่เท่าไรถึงใช้ได้
ตั้งแต่ 90 ขึ้นไปถือว่าแม่นยำมาก อ่านผ่านรอบเดียวพอ · 75–89 แม่นยำดีแต่ควรกวาดตาหาวรรณยุกต์ที่หาย · 50–74 ปานกลาง ต้องตรวจทั้งหมด · ต่ำกว่า 50 แนะนำให้ถ่ายรูปใหม่ให้ชัดขึ้นแล้วลองอีกครั้ง ตัวเลขที่ควรดูจริง ๆ คือจำนวนคำที่มั่นใจต่ำ ไม่ใช่ค่าเฉลี่ย เพราะเอกสารที่ผิดแค่ 5 คำจาก 100 คำก็ยังได้ค่าเฉลี่ยสูง ทั้งที่ 5 คำนั้นอาจเป็นตัวเลขเงินหรือชื่อคน
ควรถ่ายรูปหรือสแกนที่ความละเอียดเท่าไร
สแกนที่ 300 dpi เป็นค่ามาตรฐาน และควรให้ตัวอักษรในรูปสูงอย่างน้อย 30–40 พิกเซลสำหรับภาษาไทย ซึ่งสูงกว่าเกณฑ์ 20 พิกเซลของภาษาอังกฤษ เพราะต้องเหลือที่ให้สระและวรรณยุกต์ที่ซ้อนอยู่ด้านบนล่าง อย่าย่อรูปก่อนอัปโหลดเพราะจะทิ้งรายละเอียดที่ตัวอ่านต้องใช้ ทุกอย่างประมวลผลในเครื่องอยู่แล้ว ไฟล์ใหญ่จึงไม่เปลืองเน็ต
ตัวอักษรไทยคู่ไหนที่ OCR สลับกันบ่อย
คู่ที่ควรไล่ตรวจก่อนคือ ก/ถ/ภ · ด/ค/ต · บ/ป/ษ · ข/ช · ผ/ฝ · พ/ฬ · ฎ/ฏ และ เ/แ เพราะต่างกันแค่หัวเข้าหัวออกหรือขาสั้นขายาว ซึ่งเป็นรายละเอียดที่หายไปทันทีเมื่อภาพเบลอ อีกอาการที่พบบ่อยคือวรรณยุกต์หายไปทั้งตัว ทำให้ "ที่" กลายเป็น "ท"
ใช้เวลานานแค่ไหนในการแกะข้อความ
ขึ้นอยู่กับขนาดรูปภาพและสเปคเครื่อง โดยทั่วไปใช้เวลา 5-30 วินาที การโหลดครั้งแรกอาจนานกว่าเพราะต้องดาวน์โหลดข้อมูลภาษา (~10MB สำหรับภาษาไทย, ~4MB สำหรับภาษาอังกฤษ) หลังจากนั้นจะเร็วขึ้นเพราะ cache ไว้ในเบราว์เซอร์
แกะข้อความจากไฟล์ PDF ได้ไหม
เครื่องมือนี้รองรับเฉพาะไฟล์รูปภาพ (JPG, PNG, WebP, BMP, GIF) ถ้าต้องการแกะจาก PDF ให้จับภาพหน้าจอ (Screenshot) ของหน้าที่ต้องการแล้ววาง Ctrl+V ลงมาได้เลย หรือใช้ เครื่องมือ PDF แปลงเป็นรูปก่อน
เครื่องมืออื่นที่อาจได้ใช้
- แปลงไฟล์รูปภาพ (Image Converter) — แปลง JPG, PNG, WebP พร้อมย่อขนาด
- นับคำ & ตัวอักษรไทย — นับจำนวนคำ ตัวอักษร บรรทัด หลังแกะข้อความเสร็จ
- อ่านออกเสียงข้อความ (TTS) — แปลงข้อความที่แกะได้เป็นเสียงพูด
- สแกน & อ่าน QR Code — อ่าน QR Code จากรูปภาพหรือกล้อง
- ดูเครื่องมือทั้งหมดของ Thai Toolbox