ตัวแปลง PDF เป็นข้อความ

ถัดไป: ตรวจทาน

วิธีที่เร็วที่สุดในการดึงคำออกจาก PDF เครื่องมือนี้อ่านชั้นข้อความที่เก็บอยู่ใน PDF อยู่แล้ว ทีละหน้า และคืนข้อความล้วนที่คุณคัดลอกหรือบันทึกเป็นไฟล์ .txt ได้ ทุกอย่างทำงานในเบราว์เซอร์ของคุณ เอกสารของคุณจึงไม่ถูกอัปโหลดไปที่ใดเลย มีสิ่งหนึ่งที่ควรรู้ตั้งแต่ต้น เครื่องมือนี้อ่านข้อความที่อยู่ในไฟล์อยู่แล้ว ดังนั้นเอกสารที่สแกนหรือถ่ายภาพ (ภาพที่ไม่มีชั้นข้อความ) จะออกมาว่างเปล่า สำหรับกรณีเหล่านั้น ให้ใช้เครื่องมือ OCR แทน

วิธีดึงข้อความออกจาก PDF

  1. 1

    อัปโหลด PDF

    ลากเข้ามาหรือคลิกเพื่อเลือก ไฟล์อยู่บนอุปกรณ์ของคุณและไม่เคยถูกส่งไปยังเซิร์ฟเวอร์

  2. 2

    ดึงข้อความ

    เครื่องมืออ่านชั้นข้อความของทุกหน้าและเย็บรวมกัน โดยใส่เครื่องหมายไว้ก่อนแต่ละหน้า

  3. 3

    ตรวจดูผลลัพธ์

    ข้อความที่ดึงได้จะปรากฏในกล่อง ทีละหน้าต่อกันไป พร้อมให้ตรวจสอบ

  4. 4

    คัดลอกหรือดาวน์โหลด

    คัดลอกไปยังคลิปบอร์ด หรือบันทึกเป็นไฟล์ .txt เพื่อนำไปใช้ซ้ำที่อื่น

เครื่องมือนี้อ่านอะไรได้ และอ่านอะไรไม่ได้

ประเภทของ PDF ผลลัพธ์
ส่งออกจาก Word, Google Docs, เบราว์เซอร์ หรือเครื่องมือออกแบบ ได้ข้อความครบถ้วน สะอาด และไม่ตกหล่น
PDF ดิจิทัลที่มีชั้นข้อความอย่างถูกต้อง ดึงข้อความได้ทีละหน้า
ภาพสแกนหรือภาพถ่ายที่บันทึกเป็น PDF (เป็นภาพล้วน) ว่างหรือแทบว่างเปล่า: ไม่มีข้อความให้อ่าน
PDF ที่ป้องกันด้วยรหัสผ่าน อ่านไม่ได้จนกว่าคุณจะปลดล็อกก่อน

ที่นี่ไม่มี OCR: ใช้เครื่องมือที่เหมาะสมกับไฟล์สแกน

ตัวดึงข้อความนี้ไม่ได้รัน OCR (การรู้จำอักขระด้วยแสง) มันคัดลอกข้อความที่อยู่ใน PDF อยู่แล้ว ไม่ได้อ่านพิกเซล หากไฟล์ของคุณเป็นภาพสแกนและไม่ได้อะไรกลับมาเลย ให้ส่งผ่านเครื่องมือ OCR ก่อน ซึ่งจะเปลี่ยนภาพให้เป็นชั้นข้อความจริงที่คุณดึงออกมาได้ในภายหลัง

ข้อความถูกจัดวางอย่างไร

แต่ละหน้าคั่นด้วยเครื่องหมาย --- Page N --- เพื่อให้คุณเห็นว่าหน้าหนึ่งจบตรงไหนและหน้าถัดไปเริ่มตรงไหน ข้อความถูกดึงตามลำดับที่จัดเก็บไว้ใน PDF เอกสารส่วนใหญ่อ่านได้อย่างเป็นธรรมชาติ ส่วนไม่กี่ไฟล์ที่มีเลย์เอาต์หลายคอลัมน์แบบผิดปกติอาจสลับคอลัมน์กันไปมา เพราะเครื่องมือทำตามลำดับที่จัดเก็บไว้ใน PDF แทนที่จะเดาเส้นทางการอ่าน

การใช้งานทั่วไป

  • ป้อนให้โมเดล AI โมเดลภาษารับข้อความล้วน ไม่ใช่ PDF การดึงออกมาก่อนทำให้ทุกอย่างเร็วขึ้นและคาดเดาได้
  • อ้างอิงและค้นหา คัดลอกข้อความช่วงหนึ่งได้โดยไม่ต้องสู้กับการเลือกข้อความในโปรแกรมดู PDF
  • นำเนื้อหาไปใช้ซ้ำ ย้ายข้อความไปยังเอกสาร อีเมล หรือโน้ต โดยไม่ต้องพิมพ์ใหม่

คำถามที่พบบ่อย

ไม่ได้ มันอ่านชั้นข้อความที่ฝังอยู่ ส่วนภาพสแกนเป็นเพียงภาพที่ไม่มีชั้นข้อความ จึงออกมาว่างเปล่า ให้ใช้เครื่องมือ OCR กับเอกสารที่สแกนหรือถ่ายภาพ แล้วจึงดึงข้อความ

ไม่ การดึงข้อความทำงานทั้งหมดในเบราว์เซอร์ของคุณ บนอุปกรณ์ของคุณเอง ไฟล์ PDF ไม่เคยถูกส่งไปยังเซิร์ฟเวอร์และไม่มีการจัดเก็บสิ่งใด

PDF บางไฟล์ โดยเฉพาะเลย์เอาต์หลายคอลัมน์ จัดเก็บข้อความในลำดับที่ต่างจากที่คุณอ่าน เครื่องมือทำตามลำดับที่จัดเก็บไว้ใน PDF คอลัมน์จึงอาจสลับกันได้ ส่วนเอกสารที่ส่งออกจากโปรแกรมประมวลผลคำมักออกมาถูกต้องเสมอ

ไม่ได้ตราบใดที่ยังล็อกอยู่ ให้ลบรหัสผ่านออกก่อนด้วยเครื่องมือปลดล็อก PDF แล้วจึงดึงข้อความ

เครื่องมือที่เกี่ยวข้อง

ปิดทับ PDF บนอุปกรณ์ของคุณ

ปิดทับส่วนที่ละเอียดอ่อนด้วยตนเอง แล้วสร้าง PDF ใหม่จากภาพ JPEG ของแต่ละหน้าบนอุปกรณ์ ไฟล์จะไม่ถูกอัปโหลด และทุกหน้าของผลลัพธ์จะเป็นภาพที่ค้นหาหรือเลือกข้อความไม่ได้

ตัวสร้าง PDF ที่ค้นหาได้

เปลี่ยน PDF ที่สแกนให้เป็นเอกสารที่ค้นหาและเลือกข้อความได้ ด้วยการเพิ่มชั้นข้อความ OCR ที่มองไม่เห็น ทำงานทั้งหมดในเบราว์เซอร์ รองรับ 7 ภาษาอักษรละติน

สแกนเอกสารเป็น PDF

เปลี่ยนรูปเอกสาร JPEG, PNG หรือ WebP เป็น PDF ไฟล์เดียวในเบราว์เซอร์ เลือก A4 หรือ US Letter แนวตั้งแล้วดาวน์โหลดโดยไม่อัปโหลดรูปของคุณ.

แบบฟอร์ม PDF

กรอกช่อง AcroForm ที่มีอยู่ในเบราว์เซอร์ เก็บคำตอบเดิมไว้ และดาวน์โหลดเป็นสำเนาที่แก้ไขต่อได้หรือสำเนาแบบคงที่

ตัวแปลง HTML เป็น PDF

แปลง HTML พื้นฐานและ CSS แบบอินไลน์เป็น PDF ภาพขนาด A4, Letter หรือ Legal ภายในเบราว์เซอร์ โดยไม่อัปโหลดซอร์สโค้ดหรือไฟล์ผลลัพธ์

ดึงภาพจากไฟล์ PDF

ดึงภาพแต่ละภาพที่ฝังอยู่ในไฟล์ PDF ออกมา และดาวน์โหลดแยกกันหรือเป็นไฟล์ ZIP เดียว โดยรักษาความละเอียดเดิมไว้

เครื่องมือนี้มีให้บริการในภาษาอื่น