ตัวสร้าง PDF ที่ค้นหาได้

เลือก PDF ที่สแกนแล้ว

เฉพาะ PDF · 10 MB

PDF เท่านั้น ขนาดไม่เกิน 10 MB และ 10 หน้า

PDF ที่สแกนแท้จริงแล้วเป็นเพียงกองรูปภาพที่ห่ออยู่ในภาชนะ PDF คุณจึงไฮไลต์ คัดลอก หรือค้นหาข้อความไม่ได้ เครื่องมือนี้ทำการรู้จำอักขระด้วยแสง (OCR) ในแต่ละหน้าภายในเบราว์เซอร์ของคุณ แล้วเพิ่มผลลัพธ์เป็นชั้นข้อความที่มองไม่เห็นซึ่งจัดแนวกับหน้าต้นฉบับ เนื้อหาภาพของหน้าเดิมยังอยู่ และคุณใช้ Ctrl+F หรือเลือกข้อความจากคำที่รู้จำได้ การรู้จำอาจผิดพลาดได้ และผลลัพธ์นี้ไม่ใช่ PDF เพื่อการเข้าถึงที่มีแท็ก จึงควรเทียบข้อความสำคัญกับภาพสแกนเสมอ

วิธีทำ OCR ให้ PDF ที่สแกน

  1. 1

    อัปโหลดไฟล์สแกน

    ลาก PDF ที่สแกนเข้ามา (สัญญา ใบแจ้งหนี้ รายงานที่จัดเก็บไว้) ข้อความพิมพ์ได้ผลดีที่สุด ส่วนลายมือไม่ได้ผล

  2. 2

    เลือกภาษา

    เลือกภาษาของเอกสาร (อังกฤษ สเปน ฝรั่งเศส เยอรมัน อิตาลี โปรตุเกส หรือดัตช์) เพื่อให้เครื่อง OCR โหลดโมเดลอักขระที่ถูกต้อง

  3. 3

    เรียกใช้การรู้จำ

    แต่ละหน้าถูกเรนเดอร์ที่ความละเอียดสูงในเบราว์เซอร์ของคุณแล้วส่งเข้าเครื่อง OCR เอกสารยาวอาจใช้เวลาหลายนาที

  4. 4

    ฝังชั้นข้อความ

    คำที่รู้จำได้ถูกวางในชั้นที่มองไม่เห็นซึ่งจัดแนวกับหน้าต้นฉบับ หน้าตาแต่ละหน้าจึงไม่เปลี่ยนแปลง

  5. 5

    ดาวน์โหลด PDF ใหม่

    ได้ PDF ที่คงภาพสแกนต้นฉบับไว้ และตอนนี้ค้นหาได้ในโปรแกรมอ่านสมัยใหม่ทุกตัว

เมื่อใด OCR ได้ผลดี (และเมื่อใดไม่ได้ผล)

คุณภาพของ OCR ขึ้นอยู่กับภาพสแกน ควรเทียบชื่อ ตัวเลข และถ้อยคำทางกฎหมายที่สำคัญกับหน้าต้นฉบับเสมอ

สิ่งที่ป้อนเข้า สิ่งที่คาดหวังได้
สแกนงานพิมพ์ที่สะอาด มักได้ผลดี แต่ควรพิสูจน์อักษรข้อความสำคัญ
รูปหน้าที่พิมพ์ ผลขึ้นอยู่กับโฟกัส แสง และมุมของหน้า
หนังสือเก่าหรืองานพิมพ์ดีดที่ซีดจาง ตรวจข้อความที่รู้จำได้อย่างละเอียด
ลายมือหรือตัวเขียนติดกัน ไม่รองรับได้อย่างน่าเชื่อถือ
ใบเสร็จหรืองานพิมพ์จากเครื่องความร้อน ตรวจตัวเลขและอักขระจาง ๆ อย่างละเอียด
ข้อความที่มีการทะลุจากด้านหลังมาก ผลอาจไม่ครบถ้วนหรือไม่ถูกต้อง

PDF ที่ค้นหาได้ กับ PDF ที่เป็นภาพอย่างเดียว

  • PDF ที่เป็นภาพอย่างเดียว: บิตแมปล้วน ไม่มีข้อความ เป็นสิ่งที่เครื่องสแกนสร้างโดยค่าเริ่มต้น
  • PDF ที่ค้นหาได้: บิตแมปบวกกับชั้นข้อความที่มองไม่เห็น (สิ่งที่เครื่องมือนี้สร้าง) หน้าตาเหมือนกันทุกประการ และ Ctrl+F ใช้งานได้
  • PDF/A: ชุดย่อยของ PDF สำหรับการจัดเก็บถาวรที่ฝังฟอนต์ของตนและห้ามใช้ทรัพยากรภายนอก มักถูกเรียกร้องโดยศาลและหอจดหมายเหตุ เครื่องมือนี้สร้าง PDF ที่ค้นหาได้แบบธรรมดา ไม่ใช่ PDF/A ที่ผ่านการรับรอง หากงานของคุณต้องใช้ PDF/A ให้แปลงและตรวจสอบด้วยเครื่องมือ PDF/A โดยเฉพาะ

เคล็ดลับเพื่อผลลัพธ์ที่ดีที่สุด

  • เริ่มที่ประมาณ 300 DPI ซึ่งมักเป็นจุดสมดุลที่ใช้ได้ระหว่างรายละเอียดที่อ่านได้กับเวลาในการประมวลผล ความละเอียดที่สูงขึ้นใช้เวลาและหน่วยความจำมากขึ้น
  • แก้ความเอียงก่อนทำ OCR เครื่องสแกนส่วนใหญ่มีการหมุนอัตโนมัติ แม้เอียงเพียงเล็กน้อยก็อาจลดคุณภาพการรู้จำได้
  • หนึ่งภาษาต่อหนึ่งรอบ เครื่องรู้จำทีละภาษาเท่านั้น จึงควรเลือกภาษาหลัก สำหรับเอกสารสองภาษา ให้เรียกใช้ภาษาละครั้งแล้วเก็บผลลัพธ์ที่ดีกว่า
  • เก็บต้นฉบับไว้เสมอ OCR ทำให้เกิดข้อผิดพลาดเล็กน้อย ชั้นที่มองไม่เห็นคือความสะดวก ไม่ใช่หลักฐาน

คำถามที่พบบ่อย

เนื้อหาของหน้าต้นฉบับจะถูกเก็บไว้ ข้อความที่รู้จำได้จะถูกเพิ่มเป็นชั้นที่มองไม่เห็นซึ่งจัดแนวกับหน้าเดิม ดังนั้นหน้าควรมีลักษณะเหมือนเดิม ตรวจผลลัพธ์หากความเที่ยงตรงด้านภาพอย่างละเอียดมีความสำคัญ

เจ็ดภาษาอักษรละติน ได้แก่ อังกฤษ สเปน ฝรั่งเศส เยอรมัน อิตาลี โปรตุเกส และดัตช์ เลือกภาษาที่ตรงกับเอกสารของคุณ ส่วนอักษรอย่างซีริลลิก อาหรับ และ CJK (จีน ญี่ปุ่น เกาหลี) ไม่มีให้ใช้ในเครื่องมือนี้

ไม่ได้อย่างน่าเชื่อถือ เครื่องมือนี้ออกแบบมาสำหรับข้อความพิมพ์ การรู้จำลายมือเป็นเทคโนโลยีคนละประเภท จึงควรตรวจหรือถอดความเอกสารลายมือแยกต่างหาก

ไม่ ผลลัพธ์เป็น PDF ที่ค้นหาได้แบบธรรมดา คือภาพหน้าต้นฉบับของคุณบวกชั้นข้อความ OCR ที่มองไม่เห็น ไม่ใช่ไฟล์ PDF/A สำหรับจัดเก็บถาวรที่ผ่านการรับรอง หากงานของคุณต้องใช้ PDF/A ให้แปลงและตรวจสอบผลลัพธ์ด้วยเครื่องมือ PDF/A โดยเฉพาะ

OCR ทำงานทั้งหมดในเบราว์เซอร์ของคุณ ดังนั้น PDF ต้นฉบับจึงไม่ถูกส่งไปยังเซิร์ฟเวอร์เพื่อการรู้จำ การดาวน์โหลดในเครื่องตามปกติจะอยู่บนอุปกรณ์ของคุณ มีเพียงเมื่อคุณเลือก สร้างหน้าดาวน์โหลด เท่านั้นที่ PDF ที่ค้นหาได้ซึ่งทำเสร็จแล้วจะถูกอัปโหลดไปยังเซิร์ฟเวอร์ของเรา PDF ต้นฉบับยังคงอยู่ในเครื่อง และผลลัพธ์ที่อัปโหลดจะเก็บไว้นานสูงสุด 7 วัน

เครื่องมือที่เกี่ยวข้อง

แก้ไขไฟล์ PDF

เพิ่มข้อความ ไฮไลต์ สี่เหลี่ยม และกล่องสีขาวลงใน PDF ผ่านเบราว์เซอร์ แล้วส่งออกเป็น PDF ใหม่โดยไม่ต้องติดตั้งซอฟต์แวร์

แปลง Word เป็น PDF

แปลงเอกสาร Word .doc และ .docx เป็น PDF โดยคงเค้าโครงหน้า รูปภาพ ตาราง และหัวเรื่องไว้ อัปโหลดอย่างปลอดภัยและลบอัตโนมัติหลัง 2 ชั่วโมง

แปลง PDF เป็น PNG

แปลงหน้า PDF เป็นไฟล์ PNG ที่ตัวอักษรคมชัด รองรับพื้นหลังโปร่งใส และกำหนด DPI ได้ เหมาะสำหรับเอกสารและภาพขนาดย่อ

รวม PDF และรูปภาพ

รวม PDF กับรูปภาพ JPG หรือ PNG เป็น PDF เดียว จัดลำดับไฟล์ที่อัปโหลด แล้วดาวน์โหลดเอกสารจากเบราว์เซอร์

แปลง PDF เป็น Word

แปลง PDF เป็นเอกสาร Word ที่แก้ไขได้เต็มรูปแบบ เก็บหัวข้อ รายการ รูปภาพ และตารางไว้ พร้อมทำ OCR อัตโนมัติสำหรับ PDF ที่สแกนมา

ลบหน้าจากไฟล์ PDF

ลบหน้าหรือช่วงหน้าที่เลือกออกจากไฟล์ PDF ใส่หมายเลขเช่น 2, 5-7 โดยต้องเหลืออย่างน้อยหนึ่งหน้า แล้วดาวน์โหลด PDF ฉบับที่สั้นลง