OCR ไฟล์ PDF

เลือก PDF ที่สแกน

เฉพาะ PDF · 20 MB · 40 หน้า

หรือวาง PDF หนึ่งไฟล์ที่นี่

ใช้เครื่องมือนี้เมื่อ PDF มีภาพหน้าที่สแกนมาแทนที่จะเป็นข้อความที่เลือกได้ เครื่องมือจะแสดงผลแต่ละหน้าและใช้การรู้จำอักขระด้วยแสง (OCR) ภายในเบราว์เซอร์ จากนั้นจะแสดงข้อความล้วนที่อ่านได้ให้คุณตรวจสอบ คัดลอก หรือบันทึกเป็นไฟล์ .txt ไฟล์ PDF ต้นฉบับจะอยู่ในอุปกรณ์ของคุณ เครื่องมือนี้ไม่ได้สร้าง PDF ที่ค้นหาข้อความได้และไม่ได้รักษาเค้าโครงหน้า ผล OCR อาจมีข้อผิดพลาดได้

วิธีดึงข้อความจาก PDF ที่สแกน

  1. 1

    เลือกภาษาของเอกสาร

    เลือกภาษาหลักของข้อความสิ่งพิมพ์ ตัวเลือกนี้กำหนดโมเดล OCR ที่เบราว์เซอร์จะใช้

  2. 2

    เปิดไฟล์ PDF

    เลือก PDF หนึ่งไฟล์ที่มีขนาดไม่เกิน 20 MB และไม่เกิน 40 หน้า ไฟล์ต้นฉบับจะอยู่ในเบราว์เซอร์และไม่ถูกส่งไปยังเซิร์ฟเวอร์ของเรา

  3. 3

    รอให้ระบบอ่านเอกสาร

    เบราว์เซอร์จะแสดงผลแต่ละหน้าแล้วอ่านด้วยโมเดล OCR ที่เลือก อาจต้องดาวน์โหลดไฟล์โมเดลก่อนเริ่มการรู้จำ

  4. 4

    ตรวจสอบผลลัพธ์

    เทียบชื่อ ตัวเลข และข้อความสำคัญกับหน้าต้นฉบับ OCR เป็นเครื่องมือช่วยอ่าน ไม่ใช่สำเนาที่เชื่อถือได้ทันทีสำหรับงานสำคัญ

  5. 5

    คัดลอกหรือดาวน์โหลดข้อความ

    การคัดลอกจะเก็บผลลัพธ์ไว้ในเบราว์เซอร์ ดาวน์โหลด TXT ในเครื่องจะบันทึกไฟล์ข้อความโดยไม่อัปโหลด ส่วนการสร้างหน้าดาวน์โหลดที่มีการป้องกันเป็นตัวเลือกแยกต่างหาก

เครื่องมือนี้สร้างอะไร

ผลลัพธ์เป็นข้อความล้วน โดยมีเครื่องหมายระบุหน้าก่อนข้อความที่อ่านได้จากแต่ละหน้า เครื่องมือนี้จะไม่:

  • เพิ่มชั้นข้อความที่ซ่อนไว้ลงใน PDF
  • สร้างคอลัมน์ ตาราง แบบฟอร์ม หรือรูปแบบตัวอักษรเดิมขึ้นใหม่
  • รักษาเค้าโครงภาพของหน้า
  • แปลเอกสาร
  • ยืนยันว่าข้อความที่อ่านได้ถูกต้อง

หากต้องการ PDF ที่ยังแสดงหน้าสแกนเดิมและมีข้อความที่ค้นหาได้อยู่ด้านหลัง ให้ใช้โปรแกรมสำหรับสร้าง PDF ที่ค้นหาข้อความได้หรือซอฟต์แวร์ OCR บนเดสก์ท็อปโดยเฉพาะ

เอกสารที่เหมาะกับ OCR

OCR ออกแบบมาสำหรับข้อความสิ่งพิมพ์ ภาพสแกนที่ตรง คมชัด และมีความต่างสีชัดเจนจะอ่านได้ง่ายกว่าภาพถ่ายที่เบลอ โทรสารที่ซีด หรือหน้าที่เสียหาย ตัวอักษรตกแต่ง ลายมือ สัญลักษณ์ทางคณิตศาสตร์ คอลัมน์ที่อยู่ชิดกัน และตารางซับซ้อนอาจทำให้ข้อความผิดหรือเรียงลำดับไม่ถูกต้อง

เครื่องมือรับ PDF ขนาดไม่เกิน 20 MB และไม่เกิน 40 หน้า ระบบจะรู้จำทีละหน้าและอาจใช้หน่วยความจำมาก โดยเฉพาะหน้าขนาดใหญ่หรือความละเอียดสูง หากเบราว์เซอร์มีหน่วยความจำไม่พอ ให้แบ่ง PDF เป็นส่วนย่อยแล้วประมวลผลแยกกัน

ภาษา OCR ที่รองรับ

คุณเลือกได้จากภาษาอังกฤษ สเปน ฝรั่งเศส เยอรมัน อิตาลี โปรตุเกส ดัตช์ รัสเซีย ญี่ปุ่น จีนตัวย่อ เกาหลี และอาหรับ

เลือกภาษาหลักของเอกสารก่อนเปิดไฟล์ หน้าที่มีหลายภาษาหรือหลายระบบอักษรอาจต้องประมวลผลแยกกันหลายครั้ง และผลลัพธ์ยังอาจสับสนระหว่างอักขระที่มีรูปร่างคล้ายกัน

ตรวจสอบข้อความที่อ่านได้

เทียบผลลัพธ์กับ PDF ต้นฉบับทุกครั้งก่อนนำไปใช้ โดยตรวจสอบสิ่งต่อไปนี้เป็นพิเศษ:

  • ชื่อ ที่อยู่ และหมายเลขประจำตัว
  • วันที่ จำนวนเงิน เครื่องหมายทศนิยม และเครื่องหมายลบ
  • คำแนะนำด้านกฎหมาย การแพทย์ การเงิน หรือความปลอดภัย
  • จุดแบ่งหน้าและลำดับการอ่านในเอกสารหลายคอลัมน์

อย่าถือว่าผล OCR เป็นสำเนาที่เป็นทางการของเอกสารสำคัญ

การจัดการไฟล์และการดาวน์โหลด

PDF ต้นฉบับจะถูกอ่านภายในเบราว์เซอร์ ไม่ถูกใส่ใน URL ของขั้นตอนและไม่ถูกส่งไปยังเซิร์ฟเวอร์ของเรา เบราว์เซอร์อาจดาวน์โหลดไลบรารีสำหรับแสดงผล PDF ไลบรารี OCR และโมเดลภาษาที่เลือกจากผู้ให้บริการไลบรารีที่ตั้งค่าไว้

คัดลอก จะเก็บข้อความไว้ในเบราว์เซอร์และเขียนลงคลิปบอร์ด ดาวน์โหลด TXT ในเครื่อง จะสร้างไฟล์ .txt จากผลลัพธ์และบันทึกโดยไม่อัปโหลด หากเลือก สร้างหน้าดาวน์โหลด ระบบจะอัปโหลดเฉพาะไฟล์ข้อความที่สร้างขึ้นเพื่อทำลิงก์ที่มีการป้องกัน และอาจเก็บไฟล์ไว้สูงสุด 7 วัน หากการอัปโหลดตัวเลือกนี้ล้มเหลว การดาวน์โหลดในเครื่องยังคงใช้ได้

คำถามที่พบบ่อย

ไม่ ไฟล์ PDF ต้นฉบับจะอยู่ในเบราว์เซอร์ขณะที่ระบบแสดงผลหน้าและรู้จำข้อความ เบราว์เซอร์อาจดาวน์โหลดไลบรารีแสดงผล PDF ไลบรารี OCR และโมเดลภาษาที่เลือก การคัดลอกและดาวน์โหลด TXT ในเครื่องจะไม่อัปโหลดข้อความ มีเพียงการเลือกสร้างหน้าดาวน์โหลดเท่านั้นที่อัปโหลดไฟล์ข้อความที่สร้างขึ้น

ไม่ ผลลัพธ์เป็นข้อความล้วนที่แบ่งตามหน้า เครื่องมือไม่แก้ไข PDF ต้นฉบับ ไม่เพิ่มชั้นข้อความที่ซ่อนอยู่ และไม่รักษาเค้าโครงเดิม

ควรเทียบผลลัพธ์กับหน้าต้นฉบับ OCR อาจอ่านอักขระผิด ข้ามข้อความ หรือเปลี่ยนลำดับการอ่าน ตรวจสอบทุกรายละเอียดก่อนใช้กับงานด้านกฎหมาย การแพทย์ การเงิน ความปลอดภัย หรืองานสำคัญอื่น

เครื่องมือออกแบบมาสำหรับข้อความสิ่งพิมพ์ ลายมือ สมการ และตัวอักษรตกแต่งอาจให้ผลที่ไม่น่าเชื่อถือ อักขระในตารางอาจอ่านได้ แต่โครงสร้างแถวและคอลัมน์จะไม่ถูกเก็บไว้ในข้อความล้วน

ภาษาอังกฤษ สเปน ฝรั่งเศส เยอรมัน อิตาลี โปรตุเกส ดัตช์ รัสเซีย ญี่ปุ่น จีนตัวย่อ เกาหลี และอาหรับ เลือกภาษาหลักก่อนเปิด PDF

PDF มีขนาดได้ไม่เกิน 20 MB และไม่เกิน 40 หน้า หน้าที่ใหญ่หรือมีรายละเอียดมากยังอาจใช้หน่วยความจำเกินขีดจำกัดของเบราว์เซอร์ การแบ่งเอกสารเป็นไฟล์เล็กลงอาจช่วยได้

ดาวน์โหลด TXT ในเครื่องจะสร้างไฟล์ .txt จากข้อความโดยไม่อัปโหลด หากเลือกสร้างหน้าดาวน์โหลด ไฟล์ที่สร้างขึ้นจะถูกอัปโหลดไปยังลิงก์ที่มีการป้องกันและอาจเก็บไว้สูงสุด 7 วัน การดาวน์โหลดในเครื่องยังคงใช้ได้หากการอัปโหลดตัวเลือกล้มเหลว

เครื่องมือที่เกี่ยวข้อง

ตัวแปลง HTML เป็น PDF

แปลง HTML พื้นฐานและ CSS แบบอินไลน์เป็น PDF ภาพขนาด A4, Letter หรือ Legal ภายในเบราว์เซอร์ โดยไม่อัปโหลดซอร์สโค้ดหรือไฟล์ผลลัพธ์

ปิดทับ PDF บนอุปกรณ์ของคุณ

ปิดทับส่วนที่ละเอียดอ่อนด้วยตนเอง แล้วสร้าง PDF ใหม่จากภาพ JPEG ของแต่ละหน้าบนอุปกรณ์ ไฟล์จะไม่ถูกอัปโหลด และทุกหน้าของผลลัพธ์จะเป็นภาพที่ค้นหาหรือเลือกข้อความไม่ได้

แบบฟอร์ม PDF

กรอกช่อง AcroForm ที่มีอยู่ในเบราว์เซอร์ เก็บคำตอบเดิมไว้ และดาวน์โหลดเป็นสำเนาที่แก้ไขต่อได้หรือสำเนาแบบคงที่

ดึงภาพจากไฟล์ PDF

ดึงภาพแต่ละภาพที่ฝังอยู่ในไฟล์ PDF ออกมา และดาวน์โหลดแยกกันหรือเป็นไฟล์ ZIP เดียว โดยรักษาความละเอียดเดิมไว้

ตัวแปลงขนาดหน้ากระดาษ PDF

แปลงทุกหน้าของ PDF เป็น A4, US Letter, Legal, A3, A5 หรือ Tabloid โดยย่อ-ขยายแต่ละหน้าตามสัดส่วนให้พอดี ทำงาน 100% ในเบราว์เซอร์ของคุณ

ตัวสร้าง PDF ที่ค้นหาได้

เปลี่ยน PDF ที่สแกนให้เป็นเอกสารที่ค้นหาและเลือกข้อความได้ ด้วยการเพิ่มชั้นข้อความ OCR ที่มองไม่เห็น ทำงานทั้งหมดในเบราว์เซอร์ รองรับ 7 ภาษาอักษรละติน

เครื่องมือนี้มีให้บริการในภาษาอื่น