วิธีใช้งานเครื่องมือแกะข้อความ (OCR)
OCR คืออะไร? หลักการทำงาน
OCR (Optical Character Recognition) คือเทคโนโลยีการรู้จำตัวอักษรด้วยแสง ซึ่งแปลงรูปภาพที่มีข้อความเป็นข้อมูลดิจิทัลที่แก้ไข คัดลอก และค้นหาได้ เครื่องมือนี้ใช้ Tesseract.js ซึ่งเป็น OCR Engine โอเพนซอร์สที่ดีที่สุดตัวหนึ่งของโลก พัฒนาต้นแบบโดย HP Labs และปัจจุบันดูแลโดย Google
🔒 ความเป็นส่วนตัว: รูปภาพของคุณไม่ถูกส่งออกไปที่ใดทั้งสิ้น ทุกอย่างประมวลผลในเบราว์เซอร์ด้วย WebAssembly ข้อมูลภาษา (Language Data) จะถูก cache ไว้ในเบราว์เซอร์หลังโหลดครั้งแรก
เทคนิคถ่ายรูปให้แกะข้อความได้แม่นยำ
ข้อจำกัดของ OCR
| ข้อจำกัด | รายละเอียด |
|---|---|
| ลายมือ | OCR ถูกออกแบบมาสำหรับตัวพิมพ์ ลายมือเขียนจะแกะได้ยากและไม่แม่นยำ |
| ภาพเบลอ / ความละเอียดต่ำ | รูปที่ไม่ชัดหรือตัวอักษรเล็กมากจะทำให้ผลลัพธ์ผิดพลาด |
| ข้อความบนพื้นหลังซับซ้อน | ตัวอักษรบนพื้นหลังรูปภาพ, ลายน้ำ, หรือสีที่คล้ายกันจะแกะได้ยาก |
| ข้อความแนวตั้ง / หมุน | ข้อความที่หมุนมากกว่า 15 องศาอาจแกะไม่ถูกต้อง |
| ฟอนต์ตกแต่ง | ฟอนต์ที่มีลวดลายมาก เช่น ฟอนต์คัดลายมือหรือฟอนต์อาร์ต อาจแกะได้ไม่แม่นยำ |
คำถามที่พบบ่อย (FAQ)
รูปภาพถูกอัปโหลดขึ้นเซิร์ฟเวอร์หรือไม่
ไม่ ทุกอย่างประมวลผลในเบราว์เซอร์ของคุณเอง รูปภาพไม่ถูกส่งออกไปที่ใดทั้งสิ้น ใช้ Tesseract.js ที่ทำงานฝั่ง Client-Side 100% ปลอดภัยสำหรับเอกสารสำคัญและรูปส่วนตัว
รองรับภาษาอะไรบ้าง
รองรับภาษาไทยและภาษาอังกฤษ สามารถเลือกแกะเฉพาะภาษาเดียวหรือแกะทั้งสองภาษาพร้อมกันได้ การเลือกภาษาให้ตรงกับข้อความในรูปจะช่วยให้ผลลัพธ์แม่นยำขึ้น
ทำไมแกะข้อความไทยได้ไม่แม่นยำ
ความแม่นยำขึ้นอยู่กับคุณภาพของรูปภาพ ถ่ายรูปให้ชัด แสงสว่างเพียงพอ ตัวอักษรไม่เอียงมาก และพื้นหลังไม่รกจะช่วยได้มาก ภาษาไทยที่เป็นลายมือจะแกะได้ยากกว่าตัวพิมพ์
ใช้เวลานานแค่ไหนในการแกะข้อความ
ขึ้นอยู่กับขนาดรูปภาพและสเปคเครื่อง โดยทั่วไปใช้เวลา 5-30 วินาที การโหลดครั้งแรกอาจนานกว่าเพราะต้องดาวน์โหลดข้อมูลภาษา (~10MB สำหรับภาษาไทย, ~4MB สำหรับภาษาอังกฤษ) หลังจากนั้นจะเร็วขึ้นเพราะ cache ไว้ในเบราว์เซอร์
แกะข้อความจากไฟล์ PDF ได้ไหม
เครื่องมือนี้รองรับเฉพาะไฟล์รูปภาพ (JPG, PNG, WebP, BMP, GIF) ถ้าต้องการแกะจาก PDF ให้จับภาพหน้าจอ (Screenshot) ของหน้าที่ต้องการแล้ววาง Ctrl+V ลงมาได้เลย หรือใช้ เครื่องมือ PDF แปลงเป็นรูปก่อน
เครื่องมืออื่นที่อาจได้ใช้
- แปลงไฟล์รูปภาพ (Image Converter) — แปลง JPG, PNG, WebP พร้อมย่อขนาด
- นับคำ & ตัวอักษรไทย — นับจำนวนคำ ตัวอักษร บรรทัด หลังแกะข้อความเสร็จ
- อ่านออกเสียงข้อความ (TTS) — แปลงข้อความที่แกะได้เป็นเสียงพูด
- สแกน & อ่าน QR Code — อ่าน QR Code จากรูปภาพหรือกล้อง
- ดูเครื่องมือทั้งหมดของ Thai Toolbox