OCR ไฟล์ PDF
เซสชัน OCR นี้ไม่พร้อมใช้งานแล้ว
เลือก PDF ที่สแกน
เฉพาะ PDF · 20 MB · 40 หน้า
หรือวาง PDF หนึ่งไฟล์ที่นี่
ใช้เครื่องมือนี้เมื่อ PDF มีภาพหน้าที่สแกนมาแทนที่จะเป็นข้อความที่เลือกได้ เครื่องมือจะแสดงผลแต่ละหน้าและใช้การรู้จำอักขระด้วยแสง (OCR) ภายในเบราว์เซอร์ จากนั้นจะแสดงข้อความล้วนที่อ่านได้ให้คุณตรวจสอบ คัดลอก หรือบันทึกเป็นไฟล์ .txt ไฟล์ PDF ต้นฉบับจะอยู่ในอุปกรณ์ของคุณ เครื่องมือนี้ไม่ได้สร้าง PDF ที่ค้นหาข้อความได้และไม่ได้รักษาเค้าโครงหน้า ผล OCR อาจมีข้อผิดพลาดได้
วิธีดึงข้อความจาก PDF ที่สแกน
-
1
เลือกภาษาของเอกสาร
เลือกภาษาหลักของข้อความสิ่งพิมพ์ ตัวเลือกนี้กำหนดโมเดล OCR ที่เบราว์เซอร์จะใช้
-
2
เปิดไฟล์ PDF
เลือก PDF หนึ่งไฟล์ที่มีขนาดไม่เกิน 20 MB และไม่เกิน 40 หน้า ไฟล์ต้นฉบับจะอยู่ในเบราว์เซอร์และไม่ถูกส่งไปยังเซิร์ฟเวอร์ของเรา
-
3
รอให้ระบบอ่านเอกสาร
เบราว์เซอร์จะแสดงผลแต่ละหน้าแล้วอ่านด้วยโมเดล OCR ที่เลือก อาจต้องดาวน์โหลดไฟล์โมเดลก่อนเริ่มการรู้จำ
-
4
ตรวจสอบผลลัพธ์
เทียบชื่อ ตัวเลข และข้อความสำคัญกับหน้าต้นฉบับ OCR เป็นเครื่องมือช่วยอ่าน ไม่ใช่สำเนาที่เชื่อถือได้ทันทีสำหรับงานสำคัญ
-
5
คัดลอกหรือดาวน์โหลดข้อความ
การคัดลอกจะเก็บผลลัพธ์ไว้ในเบราว์เซอร์ ดาวน์โหลด TXT ในเครื่องจะบันทึกไฟล์ข้อความโดยไม่อัปโหลด ส่วนการสร้างหน้าดาวน์โหลดที่มีการป้องกันเป็นตัวเลือกแยกต่างหาก
เครื่องมือนี้สร้างอะไร
ผลลัพธ์เป็นข้อความล้วน โดยมีเครื่องหมายระบุหน้าก่อนข้อความที่อ่านได้จากแต่ละหน้า เครื่องมือนี้จะไม่:
- เพิ่มชั้นข้อความที่ซ่อนไว้ลงใน PDF
- สร้างคอลัมน์ ตาราง แบบฟอร์ม หรือรูปแบบตัวอักษรเดิมขึ้นใหม่
- รักษาเค้าโครงภาพของหน้า
- แปลเอกสาร
- ยืนยันว่าข้อความที่อ่านได้ถูกต้อง
หากต้องการ PDF ที่ยังแสดงหน้าสแกนเดิมและมีข้อความที่ค้นหาได้อยู่ด้านหลัง ให้ใช้โปรแกรมสำหรับสร้าง PDF ที่ค้นหาข้อความได้หรือซอฟต์แวร์ OCR บนเดสก์ท็อปโดยเฉพาะ
เอกสารที่เหมาะกับ OCR
OCR ออกแบบมาสำหรับข้อความสิ่งพิมพ์ ภาพสแกนที่ตรง คมชัด และมีความต่างสีชัดเจนจะอ่านได้ง่ายกว่าภาพถ่ายที่เบลอ โทรสารที่ซีด หรือหน้าที่เสียหาย ตัวอักษรตกแต่ง ลายมือ สัญลักษณ์ทางคณิตศาสตร์ คอลัมน์ที่อยู่ชิดกัน และตารางซับซ้อนอาจทำให้ข้อความผิดหรือเรียงลำดับไม่ถูกต้อง
เครื่องมือรับ PDF ขนาดไม่เกิน 20 MB และไม่เกิน 40 หน้า ระบบจะรู้จำทีละหน้าและอาจใช้หน่วยความจำมาก โดยเฉพาะหน้าขนาดใหญ่หรือความละเอียดสูง หากเบราว์เซอร์มีหน่วยความจำไม่พอ ให้แบ่ง PDF เป็นส่วนย่อยแล้วประมวลผลแยกกัน
ภาษา OCR ที่รองรับ
คุณเลือกได้จากภาษาอังกฤษ สเปน ฝรั่งเศส เยอรมัน อิตาลี โปรตุเกส ดัตช์ รัสเซีย ญี่ปุ่น จีนตัวย่อ เกาหลี และอาหรับ
เลือกภาษาหลักของเอกสารก่อนเปิดไฟล์ หน้าที่มีหลายภาษาหรือหลายระบบอักษรอาจต้องประมวลผลแยกกันหลายครั้ง และผลลัพธ์ยังอาจสับสนระหว่างอักขระที่มีรูปร่างคล้ายกัน
ตรวจสอบข้อความที่อ่านได้
เทียบผลลัพธ์กับ PDF ต้นฉบับทุกครั้งก่อนนำไปใช้ โดยตรวจสอบสิ่งต่อไปนี้เป็นพิเศษ:
- ชื่อ ที่อยู่ และหมายเลขประจำตัว
- วันที่ จำนวนเงิน เครื่องหมายทศนิยม และเครื่องหมายลบ
- คำแนะนำด้านกฎหมาย การแพทย์ การเงิน หรือความปลอดภัย
- จุดแบ่งหน้าและลำดับการอ่านในเอกสารหลายคอลัมน์
อย่าถือว่าผล OCR เป็นสำเนาที่เป็นทางการของเอกสารสำคัญ
การจัดการไฟล์และการดาวน์โหลด
PDF ต้นฉบับจะถูกอ่านภายในเบราว์เซอร์ ไม่ถูกใส่ใน URL ของขั้นตอนและไม่ถูกส่งไปยังเซิร์ฟเวอร์ของเรา เบราว์เซอร์อาจดาวน์โหลดไลบรารีสำหรับแสดงผล PDF ไลบรารี OCR และโมเดลภาษาที่เลือกจากผู้ให้บริการไลบรารีที่ตั้งค่าไว้
คัดลอก จะเก็บข้อความไว้ในเบราว์เซอร์และเขียนลงคลิปบอร์ด ดาวน์โหลด TXT ในเครื่อง จะสร้างไฟล์ .txt จากผลลัพธ์และบันทึกโดยไม่อัปโหลด หากเลือก สร้างหน้าดาวน์โหลด ระบบจะอัปโหลดเฉพาะไฟล์ข้อความที่สร้างขึ้นเพื่อทำลิงก์ที่มีการป้องกัน และอาจเก็บไฟล์ไว้สูงสุด 7 วัน หากการอัปโหลดตัวเลือกนี้ล้มเหลว การดาวน์โหลดในเครื่องยังคงใช้ได้
คำถามที่พบบ่อย
ไม่ ไฟล์ PDF ต้นฉบับจะอยู่ในเบราว์เซอร์ขณะที่ระบบแสดงผลหน้าและรู้จำข้อความ เบราว์เซอร์อาจดาวน์โหลดไลบรารีแสดงผล PDF ไลบรารี OCR และโมเดลภาษาที่เลือก การคัดลอกและดาวน์โหลด TXT ในเครื่องจะไม่อัปโหลดข้อความ มีเพียงการเลือกสร้างหน้าดาวน์โหลดเท่านั้นที่อัปโหลดไฟล์ข้อความที่สร้างขึ้น
ไม่ ผลลัพธ์เป็นข้อความล้วนที่แบ่งตามหน้า เครื่องมือไม่แก้ไข PDF ต้นฉบับ ไม่เพิ่มชั้นข้อความที่ซ่อนอยู่ และไม่รักษาเค้าโครงเดิม
ควรเทียบผลลัพธ์กับหน้าต้นฉบับ OCR อาจอ่านอักขระผิด ข้ามข้อความ หรือเปลี่ยนลำดับการอ่าน ตรวจสอบทุกรายละเอียดก่อนใช้กับงานด้านกฎหมาย การแพทย์ การเงิน ความปลอดภัย หรืองานสำคัญอื่น
เครื่องมือออกแบบมาสำหรับข้อความสิ่งพิมพ์ ลายมือ สมการ และตัวอักษรตกแต่งอาจให้ผลที่ไม่น่าเชื่อถือ อักขระในตารางอาจอ่านได้ แต่โครงสร้างแถวและคอลัมน์จะไม่ถูกเก็บไว้ในข้อความล้วน
ภาษาอังกฤษ สเปน ฝรั่งเศส เยอรมัน อิตาลี โปรตุเกส ดัตช์ รัสเซีย ญี่ปุ่น จีนตัวย่อ เกาหลี และอาหรับ เลือกภาษาหลักก่อนเปิด PDF
PDF มีขนาดได้ไม่เกิน 20 MB และไม่เกิน 40 หน้า หน้าที่ใหญ่หรือมีรายละเอียดมากยังอาจใช้หน่วยความจำเกินขีดจำกัดของเบราว์เซอร์ การแบ่งเอกสารเป็นไฟล์เล็กลงอาจช่วยได้
ดาวน์โหลด TXT ในเครื่องจะสร้างไฟล์ .txt จากข้อความโดยไม่อัปโหลด หากเลือกสร้างหน้าดาวน์โหลด ไฟล์ที่สร้างขึ้นจะถูกอัปโหลดไปยังลิงก์ที่มีการป้องกันและอาจเก็บไว้สูงสุด 7 วัน การดาวน์โหลดในเครื่องยังคงใช้ได้หากการอัปโหลดตัวเลือกล้มเหลว
เครื่องมือที่เกี่ยวข้อง
แก้ไขไฟล์ PDF
เพิ่มข้อความ ไฮไลต์ สี่เหลี่ยม และกล่องสีขาวลงใน PDF ผ่านเบราว์เซอร์ แล้วส่งออกเป็น PDF ใหม่โดยไม่ต้องติดตั้งซอฟต์แวร์
แปลง Word เป็น PDF
แปลงเอกสาร Word .doc และ .docx เป็น PDF โดยคงเค้าโครงหน้า รูปภาพ ตาราง และหัวเรื่องไว้ อัปโหลดอย่างปลอดภัยและลบอัตโนมัติหลัง 2 ชั่วโมง
แปลง PDF เป็น PNG
แปลงหน้า PDF เป็นไฟล์ PNG ที่ตัวอักษรคมชัด รองรับพื้นหลังโปร่งใส และกำหนด DPI ได้ เหมาะสำหรับเอกสารและภาพขนาดย่อ
รวม PDF และรูปภาพ
รวม PDF กับรูปภาพ JPG หรือ PNG เป็น PDF เดียว จัดลำดับไฟล์ที่อัปโหลด แล้วดาวน์โหลดเอกสารจากเบราว์เซอร์
แปลง PDF เป็น Word
แปลง PDF เป็นเอกสาร Word ที่แก้ไขได้เต็มรูปแบบ เก็บหัวข้อ รายการ รูปภาพ และตารางไว้ พร้อมทำ OCR อัตโนมัติสำหรับ PDF ที่สแกนมา
ลบหน้าจากไฟล์ PDF
ลบหน้าหรือช่วงหน้าที่เลือกออกจากไฟล์ PDF ใส่หมายเลขเช่น 2, 5-7 โดยต้องเหลืออย่างน้อยหนึ่งหน้า แล้วดาวน์โหลด PDF ฉบับที่สั้นลง