T
ThaiOCR

สำหรับเอกสารสแกนและไฟล์เก่า

OCR PDF ภาษาไทย
แปลง PDF สแกนเป็นข้อความที่ copy ได้

เปิด PDF แล้วลากคลุมข้อความไม่ได้ ค้นหาคำในไฟล์ก็ไม่เจอ — เพราะข้างในเป็นรูป ไม่ใช่ตัวหนังสือ ThaiOCR อ่านให้ออกมาเป็นข้อความไทยที่เอาไปใช้ต่อได้จริง

ทำไม PDF บางไฟล์ถึง copy ไม่ได้

PDF มี 2 แบบ — แบบที่ พิมพ์ออกมาจากคอม ข้างในเป็นตัวหนังสือจริง จึงลากคลุมและค้นหาได้ กับแบบที่ สแกนหรือถ่ายรูปมา ข้างในเป็นรูปภาพล้วน สายตาคนอ่านออก แต่คอมมองเห็นเป็นแค่จุดสี

เอกสารที่มักเจอปัญหานี้: สัญญาที่เซ็นแล้วสแกนกลับมา หนังสือราชการ เอกสารเก่าที่ถ่ายเอกสารต่อ ๆ กันมา ใบเสร็จที่ร้านสแกนส่งมาให้ หรือรายงานที่แปลงมาจากกระดาษ

ทางแก้เดิมคือ นั่งพิมพ์ใหม่ทั้งหมด ซึ่งกินเวลาและพิมพ์ผิดง่าย — OCR คือการให้คอมอ่านรูปนั้นแล้วถอดเป็นตัวหนังสือให้แทน

เหมาะกับงานแบบไหน

  • ต้องการ copy ข้อความจากสัญญาหรือเอกสารสแกน ไปใช้ร่างฉบับใหม่
  • อยากค้นหาคำในเอกสารเก่าที่เก็บไว้เป็นไฟล์สแกน
  • ต้องพิมพ์เอกสารกระดาษเข้าระบบ แต่ไม่อยากคีย์ใหม่ทั้งหมด
  • ทำวิจัยหรือรวบรวมข้อมูลจากเอกสารเก่าจำนวนมาก

ใช้งานใน 3 ขั้นตอน

1. อัปโหลดไฟล์ PDF

ลากไฟล์เข้ามาได้เลย ระบบนับจำนวนหน้าและบอกเครดิตที่จะใช้ก่อนเริ่ม

2. ให้ AI อ่าน

เลือก "ไม่ใช้ template" เพื่ออ่านข้อความทั้งหมด หรือใช้ template ถ้าอยากได้เฉพาะบางช่อง

3. ตรวจแล้วดาวน์โหลด

ระบบแสดงไฟล์ต้นฉบับคู่กับผลลัพธ์ให้เทียบได้ แล้วโหลดเป็น .txt .csv หรือ .json

ได้ไฟล์ออกมาเป็นอะไรบ้าง

เลือกดาวน์โหลดได้ตามที่จะเอาไปใช้ต่อ

.txt

ข้อความล้วน เอาไปวางใน Word หรือ Notepad ได้เลย

.csv

เปิดใน Excel ได้ทันที ภาษาไทยไม่เพี้ยน (ใส่ BOM ให้แล้ว)

.json

สำหรับนำเข้าระบบหรือให้โปรแกรมอ่านต่อ

ทำไมต้อง ThaiOCR

สระวรรณยุกต์ไม่เพี้ยน

เน้นเอกสารไทยโดยเฉพาะ ต่างจากเครื่องมือที่ทำมาเพื่อภาษาอังกฤษ

อ่านทีเดียวหลายหน้า

PDF หลายหน้าอ่านให้ครบในครั้งเดียว คิดเครดิตตามหน้าจริง

ต่อระบบได้

มี API ให้ระบบของคุณส่งไฟล์เข้ามาอ่านอัตโนมัติ

คำถามที่พบบ่อย

PDF ของฉัน copy ข้อความไม่ได้ ใช้ได้ไหม?

นี่แหละคือสิ่งที่ ThaiOCR ทำครับ PDF ที่ copy ไม่ได้มักเป็น PDF ที่สแกนมา ซึ่งข้างในเป็นรูปภาพ ไม่ใช่ตัวหนังสือ ระบบเราจะใช้ AI อ่านจากภาพนั้นแล้วถอดออกมาเป็นข้อความที่ copy ได้

ได้ PDF ที่ค้นหาข้อความได้กลับมาไหม?

ตอนนี้ยังไม่ได้ครับ ระบบจะให้ "ข้อความ" ที่อ่านได้ออกมาเป็นไฟล์ .txt .csv หรือ .json ไม่ได้สร้าง PDF ที่ฝังข้อความกลับไปให้ ถ้าคุณต้องการข้อความไปใช้ต่อ (พิมพ์ใหม่ ค้นหา วิเคราะห์) เราตอบโจทย์ แต่ถ้าต้องการ PDF หน้าตาเดิมที่ค้นหาได้ ระบบเรายังทำไม่ได้

PDF หลายหน้าคิดเครดิตยังไง?

คิดตามจำนวนหน้าจริงในไฟล์ 1 หน้า = 1 เครดิต (รุ่น Flash) เช่น PDF 10 หน้า = 10 เครดิต ระบบจะนับหน้าให้อัตโนมัติและเช็คเครดิตก่อนเริ่มอ่าน ถ้าเครดิตไม่พอจะแจ้งก่อน ไม่หักไปเปล่า ๆ

PDF ที่พิมพ์มาจากคอม (ไม่ได้สแกน) ใช้ได้ไหม?

ใช้ได้ครับ และผลจะยิ่งแม่น แต่ถ้า PDF นั้น copy ข้อความได้อยู่แล้ว คุณอาจ copy ตรง ๆ จาก Adobe Reader ได้เลยโดยไม่ต้องเสียเครดิต — เราแนะนำให้ใช้ ThaiOCR กับไฟล์ที่ copy ไม่ได้ หรือกรณีที่อยากดึงข้อมูลเป็นช่อง ๆ ตาม template

ตัวหนังสือไทยเพี้ยนไหม?

ThaiOCR ออกแบบมาเน้นเอกสารไทยโดยเฉพาะ สระและวรรณยุกต์จึงไม่ลอยหรือสลับตำแหน่งเหมือนเครื่องมือ OCR ทั่วไปที่ทำมาเพื่อภาษาอังกฤษ

ไฟล์ใหญ่แค่ไหนที่รองรับ?

รองรับไฟล์ทั่วไปได้สบาย ถ้าไฟล์ใหญ่มากหรือหน้าเยอะมาก แนะนำให้แบ่งไฟล์ก่อน เพื่อให้อ่านเร็วขึ้นและตรวจทานง่ายขึ้น

ลองกับ PDF ที่ copy ไม่ได้ของคุณ

สมัครฟรี ได้ 5 เครดิตทดลองทันที ไม่ต้องผูกบัตร

เริ่มใช้ฟรี