🔒 รูปไม่ถูกอัปโหลด — แกะข้อความในเครื่องคุณเอง 100%

แกะข้อความจากรูปภาพ (OCR)

ดึงข้อความ ภาษาไทย · ภาษาอังกฤษ จากภาพถ่าย สแกนเอกสาร ใบเสร็จ ป้ายโฆษณา — ลากวาง วางจาก Clipboard หรือเลือกไฟล์ แกะได้ทันทีไม่ต้องติดตั้ง

🌐 เลือกภาษาที่ต้องการแกะ
📷
ลากรูปภาพมาวางตรงนี้ หรือกดเพื่อเลือกรูป
รองรับ JPG, PNG, WebP, BMP, GIF
💡 กด Ctrl+V เพื่อวางรูปจาก Clipboard ได้ทันที
ตัวอย่างรูปภาพ
กำลังเตรียมพร้อม...
🎯 ความแม่นยำ:
📝 คำ:
🔤 ตัวอักษร:
🌐 ภาษาหลัก:

วิธีใช้งานเครื่องมือแกะข้อความ (OCR)

1️⃣ เลือกภาษา เลือกภาษาที่ตรงกับข้อความในรูป — ภาษาไทย, อังกฤษ หรือทั้งสองภาษา การเลือกภาษาให้ตรงช่วยให้แกะได้แม่นยำขึ้น
2️⃣ อัปโหลดรูปภาพ ลากวางรูปมาที่กล่อง เลือกไฟล์จากเครื่อง หรือกด Ctrl+V วางรูปจาก Clipboard สแกนได้ทั้งภาพถ่าย สแกนเอกสาร ภาพหน้าจอ
3️⃣ แกะ & คัดลอก กดปุ่ม "แกะข้อความ" รอสักครู่ ระบบจะดึงตัวอักษรออกมาให้ แก้ไขได้ทันทีในช่องผลลัพธ์ แล้วกดคัดลอกได้เลย

OCR คืออะไร? หลักการทำงาน

OCR (Optical Character Recognition) คือเทคโนโลยีการรู้จำตัวอักษรด้วยแสง ซึ่งแปลงรูปภาพที่มีข้อความเป็นข้อมูลดิจิทัลที่แก้ไข คัดลอก และค้นหาได้ เครื่องมือนี้ใช้ Tesseract.js ซึ่งเป็น OCR Engine โอเพนซอร์สที่ดีที่สุดตัวหนึ่งของโลก พัฒนาต้นแบบโดย HP Labs และปัจจุบันดูแลโดย Google

🔒 ความเป็นส่วนตัว: รูปภาพของคุณไม่ถูกส่งออกไปที่ใดทั้งสิ้น ทุกอย่างประมวลผลในเบราว์เซอร์ด้วย WebAssembly ข้อมูลภาษา (Language Data) จะถูก cache ไว้ในเบราว์เซอร์หลังโหลดครั้งแรก

เทคนิคถ่ายรูปให้แกะข้อความได้แม่นยำ

💡 แสงสว่างเพียงพอ ถ่ายในที่ที่มีแสงสว่างสม่ำเสมอ หลีกเลี่ยงเงาทับข้อความ
📐 ถ่ายตรง ไม่เอียง วางกล้องตั้งฉากกับเอกสาร หลีกเลี่ยงการถ่ายเอียงหรือบิด
🔍 โฟกัสให้ชัด ตัวอักษรต้องคมชัด ไม่เบลอ ยิ่งรูปคมยิ่งแกะได้ดี
🎯 พื้นหลังตัดกัน ข้อความสีเข้มบนพื้นสว่าง (หรือกลับกัน) ช่วยให้ OCR ทำงานได้ดีขึ้น

ข้อจำกัดของ OCR

ข้อจำกัดรายละเอียด
ลายมือ OCR ถูกออกแบบมาสำหรับตัวพิมพ์ ลายมือเขียนจะแกะได้ยากและไม่แม่นยำ
ภาพเบลอ / ความละเอียดต่ำ รูปที่ไม่ชัดหรือตัวอักษรเล็กมากจะทำให้ผลลัพธ์ผิดพลาด
ข้อความบนพื้นหลังซับซ้อน ตัวอักษรบนพื้นหลังรูปภาพ, ลายน้ำ, หรือสีที่คล้ายกันจะแกะได้ยาก
ข้อความแนวตั้ง / หมุน ข้อความที่หมุนมากกว่า 15 องศาอาจแกะไม่ถูกต้อง
ฟอนต์ตกแต่ง ฟอนต์ที่มีลวดลายมาก เช่น ฟอนต์คัดลายมือหรือฟอนต์อาร์ต อาจแกะได้ไม่แม่นยำ

ทำไม OCR ภาษาไทยยากกว่าภาษาอังกฤษมาก

ถ้าเคยลองแกะข้อความภาษาอังกฤษแล้วได้ผลเกือบเป๊ะ แต่พอเปลี่ยนเป็นไทยกลับเพี้ยนไปหมด นั่นไม่ใช่เพราะเครื่องมือไม่ดี แต่เพราะตัวเขียนภาษาไทยยากกว่าจริง ๆ อยู่สามเรื่อง

1. ตัวอักษรไทยวางซ้อนกันสี่ชั้น

ภาษาอังกฤษเรียงตัวอักษรไปทางเดียวคือแนวนอน แต่ภาษาไทยวางซ้อนกันในแนวตั้งได้ถึง 4 ชั้น — สระบนบน (ไม้โท) สระบน (สระอิ) พยัญชนะ และสระล่าง (สระอุ) คำว่า “ปุ่ม” มีทั้งสระล่างและวรรณยุกต์บน ส่วน “ที่” มีสระอิกับไม้เอกซ้อนกันสองชั้นเหนือพยัญชนะ

OCR ต้องแยกให้ออกว่าจุดหมึกที่อยู่เหนือตัวอักษรคือวรรณยุกต์ สระ หรือแค่รอยเปื้อนบนกระดาษ ซึ่งถ้ารูปความละเอียดต่ำ เครื่องหมายเล็ก ๆ พวกนี้จะหายไปก่อนเพื่อนเสมอ ผลคือได้ข้อความที่พยัญชนะถูกแต่วรรณยุกต์หาย — “ที่” กลายเป็น “ท”

2. ไม่มีช่องว่างระหว่างคำ

OCR ภาษาอังกฤษใช้ช่องว่างเป็นตัวช่วยตัดสินขอบเขตของคำ แล้วเอาคำที่ได้ไปเทียบกับพจนานุกรมเพื่อแก้ตัวอักษรที่อ่านพลาด แต่ภาษาไทยเขียนติดกันหมด ตัวช่วยนี้จึงหายไป ตัวอักษรที่อ่านพลาดหนึ่งตัวเลยไม่ถูกจับได้ และลามไปทำให้ตัดคำผิดต่อกันเป็นแถบ

3. พยัญชนะหลายคู่หน้าตาต่างกันนิดเดียว

ภาษาไทยมีพยัญชนะ 44 ตัวในพื้นที่รูปทรงที่จำกัด หลายคู่ต่างกันแค่หัวเข้าหัวออก หรือขาสั้นขายาว ซึ่งเป็นรายละเอียดที่หายไปทันทีเมื่อภาพเบลอ นี่คือคู่ที่ควรไล่ตรวจก่อนเสมอหลังแกะข้อความเสร็จ

คู่พยัญชนะไทยที่ OCR มักสับสน
คู่ที่มักสลับกันต่างกันตรงไหนเจอบ่อยในคำ
ก · ถ · ภหัวและขาด้านขวากัน / ถัง / ภาพ
ด · ค · ตยอดบนซ้ายและหัวดี / คี / ตี
บ · ป · ษขาที่ยื่นขึ้นด้านขวาบ้าน / ป้าน / ษ
ข · ชหัวเข้าหรือหัวออกขาย / ชาย
ผ · ฝเส้นเล็กบนขาขวาผัด / ฝัด
พ · ฬขาที่สามและหางพาน / ฬ
ฎ · ฏหัวมนหรือหัวหยักกฎ / ปฏิบัติ
เ · แขีดเดียวหรือสองขีดเก่ง / แก่ง

💡 เทคนิคตรวจงานเร็ว ๆ: หลังแกะข้อความเสร็จ ให้กวาดตาหาคำที่อ่านแล้วไม่เป็นภาษาก่อน ส่วนใหญ่จะเป็นคู่ในตารางนี้สลับกัน หรือวรรณยุกต์หายไป ถ้ามีข้อความยาวมาก ลองเอาไปวางในหน้า นับคำ & ตัวอักษรไทย แล้วดูรายการคำที่ตัดได้ — คำที่ตัดออกมาแล้วดูแปลกคือจุดที่ควรไปตรวจ

ค่าความเชื่อมั่นบอกอะไร และควรเชื่อที่เท่าไร

นอกจากตัวข้อความ ระบบยังให้ค่าความเชื่อมั่นมาด้วย ซึ่งเป็นคะแนน 0–100 ที่บอกว่าตัว OCR เองมั่นใจแค่ไหนกับสิ่งที่อ่านได้ ไม่ใช่การรับประกันว่าถูก แต่ใช้ตัดสินได้ว่าควรตรวจงานละเอียดแค่ไหน

เกณฑ์ค่าความเชื่อมั่นของการแกะข้อความ
คะแนนเฉลี่ยป้ายที่แสดงควรทำอะไรต่อ
90–100แม่นยำมากอ่านผ่านรอบเดียวพอ ตรวจเฉพาะตัวเลขและชื่อเฉพาะ
75–89แม่นยำดีใช้ได้ แต่ควรกวาดตาหาวรรณยุกต์ที่หาย
50–74ปานกลางต้องตรวจทั้งหมด อาจคุ้มกว่าถ้าถ่ายรูปใหม่
ต่ำกว่า 50ต่ำอย่าเพิ่งใช้ ถ่ายใหม่ให้ชัดขึ้นแล้วลองอีกครั้ง

ระบบยังนับแยกเป็นรายคำด้วยว่ามีกี่คำที่มั่นใจสูง (ตั้งแต่ 80 ขึ้นไป) กี่คำปานกลาง (50–79) และกี่คำที่มั่นใจต่ำ (ต่ำกว่า 50) ตัวเลขที่ควรดูจริง ๆ คือจำนวนคำที่มั่นใจต่ำ ไม่ใช่ค่าเฉลี่ย เพราะเอกสารที่มีคำถูกต้อง 95 คำและผิดยับ 5 คำ จะได้ค่าเฉลี่ยสูงจนดูน่าไว้ใจ ทั้งที่ 5 คำนั้นอาจเป็นตัวเลขเงินหรือชื่อคน

ถ่ายหรือสแกนที่ความละเอียดเท่าไรถึงพอ

ปัจจัยเดียวที่มีผลมากที่สุดต่อความแม่นยำคือ ตัวอักษรในรูปสูงกี่พิกเซล ไม่ใช่ขนาดไฟล์หรือความละเอียดรวมของภาพ

⚠️ อย่าย่อรูปก่อนอัปโหลด: หลายคนย่อรูปให้เล็กลงเพราะกลัวช้า แต่กับ OCR การย่อรูปคือการทิ้งรายละเอียด ที่ตัวอ่านต้องใช้โดยตรง โดยเฉพาะวรรณยุกต์ไทยที่กินพื้นที่ไม่กี่พิกเซลอยู่แล้ว ทุกอย่างทำงานในเครื่องคุณเอง ไม่ได้อัปโหลดขึ้นเน็ต ไฟล์ใหญ่จึงไม่ได้เปลืองเน็ต แค่ใช้เวลาประมวลผลนานขึ้นเท่านั้น

ที่มาของข้อมูล: เกณฑ์ค่าความเชื่อมั่น (90 / 75 / 50) และการนับคำแยกกลุ่ม (80 / 50) อ่านจาก /assets/ocr.js ซึ่งเป็นโมดูลเดียวกับที่เครื่องมือด้านบนใช้ ตรวจเมื่อ 16 สิงหาคม 2569 · ตัวอ่านข้อความเป็น Tesseract.js ซึ่งเป็นโอเพนซอร์ส ทำงานด้วย WebAssembly ในเบราว์เซอร์ · เกณฑ์ความสูงตัวอักษรและ 300 dpi เป็นแนวปฏิบัติทั่วไปของงาน OCR ไม่ใช่ค่าตายตัว — ผลจริงขึ้นกับฟอนต์ คุณภาพกระดาษ และแสงตอนถ่าย คู่พยัญชนะในตารางรวบรวมจากรูปแบบความผิดพลาดที่พบบ่อย ไม่ใช่รายการที่ครบถ้วนทุกกรณี

คำถามที่พบบ่อย (FAQ)

รูปภาพถูกอัปโหลดขึ้นเซิร์ฟเวอร์หรือไม่

ไม่ ทุกอย่างประมวลผลในเบราว์เซอร์ของคุณเอง รูปภาพไม่ถูกส่งออกไปที่ใดทั้งสิ้น ใช้ Tesseract.js ที่ทำงานฝั่ง Client-Side 100% ปลอดภัยสำหรับเอกสารสำคัญและรูปส่วนตัว

รองรับภาษาอะไรบ้าง

รองรับภาษาไทยและภาษาอังกฤษ สามารถเลือกแกะเฉพาะภาษาเดียวหรือแกะทั้งสองภาษาพร้อมกันได้ การเลือกภาษาให้ตรงกับข้อความในรูปจะช่วยให้ผลลัพธ์แม่นยำขึ้น

ทำไมแกะข้อความไทยได้ไม่แม่นยำ

ความแม่นยำขึ้นอยู่กับคุณภาพของรูปภาพ ถ่ายรูปให้ชัด แสงสว่างเพียงพอ ตัวอักษรไม่เอียงมาก และพื้นหลังไม่รกจะช่วยได้มาก ภาษาไทยที่เป็นลายมือจะแกะได้ยากกว่าตัวพิมพ์

ค่าความเชื่อมั่นควรอยู่ที่เท่าไรถึงใช้ได้

ตั้งแต่ 90 ขึ้นไปถือว่าแม่นยำมาก อ่านผ่านรอบเดียวพอ · 75–89 แม่นยำดีแต่ควรกวาดตาหาวรรณยุกต์ที่หาย · 50–74 ปานกลาง ต้องตรวจทั้งหมด · ต่ำกว่า 50 แนะนำให้ถ่ายรูปใหม่ให้ชัดขึ้นแล้วลองอีกครั้ง ตัวเลขที่ควรดูจริง ๆ คือจำนวนคำที่มั่นใจต่ำ ไม่ใช่ค่าเฉลี่ย เพราะเอกสารที่ผิดแค่ 5 คำจาก 100 คำก็ยังได้ค่าเฉลี่ยสูง ทั้งที่ 5 คำนั้นอาจเป็นตัวเลขเงินหรือชื่อคน

ควรถ่ายรูปหรือสแกนที่ความละเอียดเท่าไร

สแกนที่ 300 dpi เป็นค่ามาตรฐาน และควรให้ตัวอักษรในรูปสูงอย่างน้อย 30–40 พิกเซลสำหรับภาษาไทย ซึ่งสูงกว่าเกณฑ์ 20 พิกเซลของภาษาอังกฤษ เพราะต้องเหลือที่ให้สระและวรรณยุกต์ที่ซ้อนอยู่ด้านบนล่าง อย่าย่อรูปก่อนอัปโหลดเพราะจะทิ้งรายละเอียดที่ตัวอ่านต้องใช้ ทุกอย่างประมวลผลในเครื่องอยู่แล้ว ไฟล์ใหญ่จึงไม่เปลืองเน็ต

ตัวอักษรไทยคู่ไหนที่ OCR สลับกันบ่อย

คู่ที่ควรไล่ตรวจก่อนคือ ก/ถ/ภ · ด/ค/ต · บ/ป/ษ · ข/ช · ผ/ฝ · พ/ฬ · ฎ/ฏ และ เ/แ เพราะต่างกันแค่หัวเข้าหัวออกหรือขาสั้นขายาว ซึ่งเป็นรายละเอียดที่หายไปทันทีเมื่อภาพเบลอ อีกอาการที่พบบ่อยคือวรรณยุกต์หายไปทั้งตัว ทำให้ "ที่" กลายเป็น "ท"

ใช้เวลานานแค่ไหนในการแกะข้อความ

ขึ้นอยู่กับขนาดรูปภาพและสเปคเครื่อง โดยทั่วไปใช้เวลา 5-30 วินาที การโหลดครั้งแรกอาจนานกว่าเพราะต้องดาวน์โหลดข้อมูลภาษา (~10MB สำหรับภาษาไทย, ~4MB สำหรับภาษาอังกฤษ) หลังจากนั้นจะเร็วขึ้นเพราะ cache ไว้ในเบราว์เซอร์

แกะข้อความจากไฟล์ PDF ได้ไหม

เครื่องมือนี้รองรับเฉพาะไฟล์รูปภาพ (JPG, PNG, WebP, BMP, GIF) ถ้าต้องการแกะจาก PDF ให้จับภาพหน้าจอ (Screenshot) ของหน้าที่ต้องการแล้ววาง Ctrl+V ลงมาได้เลย หรือใช้ เครื่องมือ PDF แปลงเป็นรูปก่อน

เครื่องมืออื่นที่อาจได้ใช้

🔗 เครื่องมือที่เกี่ยวข้อง

ดูเครื่องมือทั้งหมด ➔
🖼️
แปลงไฟล์รูปภาพ
แปลง JPG, PNG, WebP พร้อมย่อขนาดและลดขนาดไฟล์
📝
นับคำ & ตัวอักษรไทย
นับจำนวนคำ ตัวอักษร บรรทัด และประโยคภาษาไทย
🔊
อ่านออกเสียงข้อความ (TTS)
แปลงข้อความเป็นเสียงพูดภาษาไทย-อังกฤษ