ตัวสร้าง PDF ที่ค้นหาได้

เลือก PDF ที่สแกนแล้ว

เฉพาะ PDF · 10 MB

PDF เท่านั้น ขนาดไม่เกิน 10 MB และ 10 หน้า

เริ่มการรู้จำในเครื่อง

PDF ที่สแกนแท้จริงแล้วเป็นเพียงกองรูปภาพที่ห่ออยู่ในภาชนะ PDF คุณจึงไฮไลต์ คัดลอก หรือค้นหาข้อความไม่ได้ เครื่องมือนี้ทำการรู้จำอักขระด้วยแสง (OCR) ในแต่ละหน้าภายในเบราว์เซอร์ของคุณ แล้วเพิ่มผลลัพธ์เป็นชั้นข้อความที่มองไม่เห็นซึ่งจัดแนวกับหน้าต้นฉบับ เนื้อหาภาพของหน้าเดิมยังอยู่ และคุณใช้ Ctrl+F หรือเลือกข้อความจากคำที่รู้จำได้ การรู้จำอาจผิดพลาดได้ และผลลัพธ์นี้ไม่ใช่ PDF เพื่อการเข้าถึงที่มีแท็ก จึงควรเทียบข้อความสำคัญกับภาพสแกนเสมอ

วิธีทำ OCR ให้ PDF ที่สแกน

  1. 1

    อัปโหลดไฟล์สแกน

    ลาก PDF ที่สแกนเข้ามา (สัญญา ใบแจ้งหนี้ รายงานที่จัดเก็บไว้) ข้อความพิมพ์ได้ผลดีที่สุด ส่วนลายมือไม่ได้ผล

  2. 2

    เลือกภาษา

    เลือกภาษาของเอกสาร (อังกฤษ สเปน ฝรั่งเศส เยอรมัน อิตาลี โปรตุเกส หรือดัตช์) เพื่อให้เครื่อง OCR โหลดโมเดลอักขระที่ถูกต้อง

  3. 3

    เรียกใช้การรู้จำ

    แต่ละหน้าถูกเรนเดอร์ที่ความละเอียดสูงในเบราว์เซอร์ของคุณแล้วส่งเข้าเครื่อง OCR เอกสารยาวอาจใช้เวลาหลายนาที

  4. 4

    ฝังชั้นข้อความ

    คำที่รู้จำได้ถูกวางในชั้นที่มองไม่เห็นซึ่งจัดแนวกับหน้าต้นฉบับ หน้าตาแต่ละหน้าจึงไม่เปลี่ยนแปลง

  5. 5

    ดาวน์โหลด PDF ใหม่

    ได้ PDF ที่คงภาพสแกนต้นฉบับไว้ และตอนนี้ค้นหาได้ในโปรแกรมอ่านสมัยใหม่ทุกตัว

เมื่อใด OCR ได้ผลดี (และเมื่อใดไม่ได้ผล)

คุณภาพของ OCR ขึ้นอยู่กับภาพสแกน ควรเทียบชื่อ ตัวเลข และถ้อยคำทางกฎหมายที่สำคัญกับหน้าต้นฉบับเสมอ

สิ่งที่ป้อนเข้า สิ่งที่คาดหวังได้
สแกนงานพิมพ์ที่สะอาด มักได้ผลดี แต่ควรพิสูจน์อักษรข้อความสำคัญ
รูปหน้าที่พิมพ์ ผลขึ้นอยู่กับโฟกัส แสง และมุมของหน้า
หนังสือเก่าหรืองานพิมพ์ดีดที่ซีดจาง ตรวจข้อความที่รู้จำได้อย่างละเอียด
ลายมือหรือตัวเขียนติดกัน ไม่รองรับได้อย่างน่าเชื่อถือ
ใบเสร็จหรืองานพิมพ์จากเครื่องความร้อน ตรวจตัวเลขและอักขระจาง ๆ อย่างละเอียด
ข้อความที่มีการทะลุจากด้านหลังมาก ผลอาจไม่ครบถ้วนหรือไม่ถูกต้อง

PDF ที่ค้นหาได้ กับ PDF ที่เป็นภาพอย่างเดียว

  • PDF ที่เป็นภาพอย่างเดียว: บิตแมปล้วน ไม่มีข้อความ เป็นสิ่งที่เครื่องสแกนสร้างโดยค่าเริ่มต้น
  • PDF ที่ค้นหาได้: บิตแมปบวกกับชั้นข้อความที่มองไม่เห็น (สิ่งที่เครื่องมือนี้สร้าง) หน้าตาเหมือนกันทุกประการ และ Ctrl+F ใช้งานได้
  • PDF/A: ชุดย่อยของ PDF สำหรับการจัดเก็บถาวรที่ฝังฟอนต์ของตนและห้ามใช้ทรัพยากรภายนอก มักถูกเรียกร้องโดยศาลและหอจดหมายเหตุ เครื่องมือนี้สร้าง PDF ที่ค้นหาได้แบบธรรมดา ไม่ใช่ PDF/A ที่ผ่านการรับรอง หากงานของคุณต้องใช้ PDF/A ให้แปลงและตรวจสอบด้วยเครื่องมือ PDF/A โดยเฉพาะ

เคล็ดลับเพื่อผลลัพธ์ที่ดีที่สุด

  • เริ่มที่ประมาณ 300 DPI ซึ่งมักเป็นจุดสมดุลที่ใช้ได้ระหว่างรายละเอียดที่อ่านได้กับเวลาในการประมวลผล ความละเอียดที่สูงขึ้นใช้เวลาและหน่วยความจำมากขึ้น
  • แก้ความเอียงก่อนทำ OCR เครื่องสแกนส่วนใหญ่มีการหมุนอัตโนมัติ แม้เอียงเพียงเล็กน้อยก็อาจลดคุณภาพการรู้จำได้
  • หนึ่งภาษาต่อหนึ่งรอบ เครื่องรู้จำทีละภาษาเท่านั้น จึงควรเลือกภาษาหลัก สำหรับเอกสารสองภาษา ให้เรียกใช้ภาษาละครั้งแล้วเก็บผลลัพธ์ที่ดีกว่า
  • เก็บต้นฉบับไว้เสมอ OCR ทำให้เกิดข้อผิดพลาดเล็กน้อย ชั้นที่มองไม่เห็นคือความสะดวก ไม่ใช่หลักฐาน

คำถามที่พบบ่อย

เนื้อหาของหน้าต้นฉบับจะถูกเก็บไว้ ข้อความที่รู้จำได้จะถูกเพิ่มเป็นชั้นที่มองไม่เห็นซึ่งจัดแนวกับหน้าเดิม ดังนั้นหน้าควรมีลักษณะเหมือนเดิม ตรวจผลลัพธ์หากความเที่ยงตรงด้านภาพอย่างละเอียดมีความสำคัญ

เจ็ดภาษาอักษรละติน ได้แก่ อังกฤษ สเปน ฝรั่งเศส เยอรมัน อิตาลี โปรตุเกส และดัตช์ เลือกภาษาที่ตรงกับเอกสารของคุณ ส่วนอักษรอย่างซีริลลิก อาหรับ และ CJK (จีน ญี่ปุ่น เกาหลี) ไม่มีให้ใช้ในเครื่องมือนี้

ไม่ได้อย่างน่าเชื่อถือ เครื่องมือนี้ออกแบบมาสำหรับข้อความพิมพ์ การรู้จำลายมือเป็นเทคโนโลยีคนละประเภท จึงควรตรวจหรือถอดความเอกสารลายมือแยกต่างหาก

ไม่ ผลลัพธ์เป็น PDF ที่ค้นหาได้แบบธรรมดา คือภาพหน้าต้นฉบับของคุณบวกชั้นข้อความ OCR ที่มองไม่เห็น ไม่ใช่ไฟล์ PDF/A สำหรับจัดเก็บถาวรที่ผ่านการรับรอง หากงานของคุณต้องใช้ PDF/A ให้แปลงและตรวจสอบผลลัพธ์ด้วยเครื่องมือ PDF/A โดยเฉพาะ

OCR ทำงานทั้งหมดในเบราว์เซอร์ของคุณ ดังนั้น PDF ต้นฉบับจึงไม่ถูกส่งไปยังเซิร์ฟเวอร์เพื่อการรู้จำ การดาวน์โหลดในเครื่องตามปกติจะอยู่บนอุปกรณ์ของคุณ มีเพียงเมื่อคุณเลือก สร้างหน้าดาวน์โหลด เท่านั้นที่ PDF ที่ค้นหาได้ซึ่งทำเสร็จแล้วจะถูกอัปโหลดไปยังเซิร์ฟเวอร์ของเรา PDF ต้นฉบับยังคงอยู่ในเครื่อง และผลลัพธ์ที่อัปโหลดจะเก็บไว้นานสูงสุด 7 วัน

เครื่องมือที่เกี่ยวข้อง

ปิดทับ PDF บนอุปกรณ์ของคุณ

ปิดทับส่วนที่ละเอียดอ่อนด้วยตนเอง แล้วสร้าง PDF ใหม่จากภาพ JPEG ของแต่ละหน้าบนอุปกรณ์ ไฟล์จะไม่ถูกอัปโหลด และทุกหน้าของผลลัพธ์จะเป็นภาพที่ค้นหาหรือเลือกข้อความไม่ได้

ตัวแปลง HTML เป็น PDF

แปลง HTML พื้นฐานและ CSS แบบอินไลน์เป็น PDF ภาพขนาด A4, Letter หรือ Legal ภายในเบราว์เซอร์ โดยไม่อัปโหลดซอร์สโค้ดหรือไฟล์ผลลัพธ์

แบบฟอร์ม PDF

กรอกช่อง AcroForm ที่มีอยู่ในเบราว์เซอร์ เก็บคำตอบเดิมไว้ และดาวน์โหลดเป็นสำเนาที่แก้ไขต่อได้หรือสำเนาแบบคงที่

ดึงภาพจากไฟล์ PDF

ดึงภาพแต่ละภาพที่ฝังอยู่ในไฟล์ PDF ออกมา และดาวน์โหลดแยกกันหรือเป็นไฟล์ ZIP เดียว โดยรักษาความละเอียดเดิมไว้

สแกนเอกสารเป็น PDF

เปลี่ยนรูปเอกสาร JPEG, PNG หรือ WebP เป็น PDF ไฟล์เดียวในเบราว์เซอร์ เลือก A4 หรือ US Letter แนวตั้งแล้วดาวน์โหลดโดยไม่อัปโหลดรูปของคุณ.

ตัวแปลงขนาดหน้ากระดาษ PDF

แปลงทุกหน้าของ PDF เป็น A4, US Letter, Legal, A3, A5 หรือ Tabloid โดยย่อ-ขยายแต่ละหน้าตามสัดส่วนให้พอดี ทำงาน 100% ในเบราว์เซอร์ของคุณ

เครื่องมือนี้มีให้บริการในภาษาอื่น