โปรแกรมแปลงไฟล์ PDF เป็น HTML

แปลงเป็น HTML
ถัดไป

โปรแกรมแปลงนี้อ่านข้อความใน PDF ของคุณและห่อไว้ในไฟล์ HTML ที่สะอาดและเรียบง่าย โดยมี <section> หนึ่งอันต่อหนึ่งหน้า หัวข้อหน้า <h2> และย่อหน้า <p> ทั้งหมดทำงานในเบราว์เซอร์ของคุณด้วย PDF.js ไฟล์จึงไม่เคยถูกอัปโหลดเลย ผลลัพธ์คือ HTML แบบเรียบที่มีเฉพาะข้อความ ซึ่งคุณสามารถเปิด แก้ไข หรือวางลงใน CMS แล้วจัดสไตล์ด้วย CSS ของคุณเองได้ มันถูกสร้างขึ้นเพื่อนำข้อความของ PDF ขึ้นเว็บ ไม่ใช่เพื่อจำลองหน้าเอกสารที่ออกแบบไว้

วิธีแปลง PDF เป็น HTML

  1. 1

    เลือก PDF ของคุณ

    ลาก PDF ที่เป็นข้อความมาวางในกล่อง หรือคลิกเพื่อเลือกไฟล์ ทุกอย่างยังคงอยู่ในเบราว์เซอร์ของคุณ

  2. 2

    แปลงเป็น HTML

    PDF.js อ่านแต่ละหน้าและดึงข้อความออกมา โดยจัดกลุ่มบรรทัดให้เป็นย่อหน้า

  3. 3

    ตรวจสอบ HTML

    มาร์กอัปที่สร้างขึ้นจะปรากฏในกล่องแสดงตัวอย่างเพื่อให้คุณตรวจสอบผลลัพธ์ได้

  4. 4

    ดาวน์โหลดไฟล์

    บันทึกไฟล์ `.html` เพียงไฟล์เดียวที่มีหนึ่งส่วนต่อหนึ่งหน้า พร้อมสำหรับแก้ไขหรือจัดสไตล์ใหม่

ผลลัพธ์มีหน้าตาเป็นอย่างไร

โปรแกรมแปลงจะสร้างไฟล์ HTML5 ที่ถูกต้องหนึ่งไฟล์ ด้วยโครงสร้างที่เรียบง่ายที่สุด

องค์ประกอบ มาจากที่ใด
โครง <!DOCTYPE html> ตัวห่อ HTML5 มาตรฐานพร้อมชุดอักขระ UTF-8
<title> ชื่อไฟล์ของ PDF ของคุณ
<section data-page> หนึ่งบล็อกต่อหนึ่งหน้าของ PDF
<h2>หน้า N</h2> หัวข้อที่บอกจุดเริ่มต้นของแต่ละหน้า
<p> บรรทัดข้อความที่จัดกลุ่มเป็นย่อหน้าตามช่องว่างแนวตั้ง

สิ่งที่มันไม่ทำ

นี่คือเครื่องมือดึงข้อความ ไม่ใช่เครื่องมือจัดเลย์เอาต์ ผลลัพธ์จึงตั้งใจ ไม่ รวมสิ่งต่อไปนี้

  • รูปภาพ โลโก้ หรือภาพประกอบจาก PDF
  • ตาราง รายการหัวข้อย่อย หรือรายการลำดับเลข ในรูปแบบ <table>/<ul>/<ol> ของ HTML
  • แบบอักษร สี คอลัมน์ หรือการจัดตำแหน่งดั้งเดิม
  • CSS หรือสไตล์แบบอินไลน์ใด ๆ

คุณจะได้คำต่าง ๆ ตามลำดับการอ่าน ห่อไว้ในย่อหน้าที่สื่อความหมาย เท่านั้น ไม่มีอย่างอื่น แล้วค่อยเพิ่ม CSS ของคุณเองภายหลัง

เพื่อผลลัพธ์ที่ดีที่สุด

  • ใช้ PDF ที่เป็นข้อความ (ไฟล์ที่คุณเลือกข้อความได้ในโปรแกรมอ่าน) PDF ที่สแกนหรือเป็นรูปภาพล้วนจะไม่มีชั้นข้อความ และที่นี่ไม่มี OCR ผลลัพธ์ของหน้าเหล่านั้นจึงจะว่างเปล่า
  • นำไฟล์ผ่าน prettier --parser html หรือตัวจัดรูปแบบ เพื่อจัดระเบียบช่องว่างก่อนคอมมิต
  • กำลังย้ายไปยัง WordPress หรือ? ให้วาง HTML ในบล็อกโค้ด/HTML ไม่ใช่ในตัวแก้ไขแบบภาพ ซึ่งจะห่อมันใหม่

ไม่ใช่เครื่องมือจัดเลย์เอาต์

อย่าคาดหวังให้ HTML ดูเหมือน PDF เว็บมีความยืดหยุ่น ส่วนหน้า PDF นั้นคงที่ ใช้เครื่องมือนี้เมื่อคุณต้องการนำเนื้อหาขึ้นเว็บ แล้วค่อยจัดสไตล์ใหม่ด้วย CSS ของเว็บไซต์คุณเอง

คำถามที่พบบ่อย

ไม่ เครื่องมือนี้ดึงข้อความออกมาและจัดวางไว้ในย่อหน้าแบบง่าย แบบอักษร สี คอลัมน์ และการจัดตำแหน่งจะไม่ถูกจำลอง ให้จัดสไตล์ผลลัพธ์ด้วย CSS ของคุณเอง

ไม่ ดึงออกมาเฉพาะข้อความเท่านั้น รูปภาพ โลโก้ และภาพประกอบจะไม่ถูกนำเข้าสู่ HTML

ได้เฉพาะเมื่อ PDF มีชั้นข้อความจริงเท่านั้น หน้าที่สแกนหรือถ่ายภาพมาเป็นรูปภาพที่ไม่มีข้อความให้เลือกได้ และที่นี่ไม่มี OCR หน้าเหล่านั้นจึงไม่ได้ข้อความออกมา

ไม่ การแปลงทั้งหมดทำงานในเบราว์เซอร์ของคุณด้วย PDF.js ไฟล์ PDF ไม่เคยออกจากอุปกรณ์ของคุณ จึงปลอดภัยสำหรับเอกสารลับ

เครื่องมือที่เกี่ยวข้อง

ปิดทับ PDF บนอุปกรณ์ของคุณ

ปิดทับส่วนที่ละเอียดอ่อนด้วยตนเอง แล้วสร้าง PDF ใหม่จากภาพ JPEG ของแต่ละหน้าบนอุปกรณ์ ไฟล์จะไม่ถูกอัปโหลด และทุกหน้าของผลลัพธ์จะเป็นภาพที่ค้นหาหรือเลือกข้อความไม่ได้

ตัวสร้าง PDF ที่ค้นหาได้

เปลี่ยน PDF ที่สแกนให้เป็นเอกสารที่ค้นหาและเลือกข้อความได้ ด้วยการเพิ่มชั้นข้อความ OCR ที่มองไม่เห็น ทำงานทั้งหมดในเบราว์เซอร์ รองรับ 7 ภาษาอักษรละติน

แบบฟอร์ม PDF

กรอกช่อง AcroForm ที่มีอยู่ในเบราว์เซอร์ เก็บคำตอบเดิมไว้ และดาวน์โหลดเป็นสำเนาที่แก้ไขต่อได้หรือสำเนาแบบคงที่

ตัวแปลง HTML เป็น PDF

แปลง HTML พื้นฐานและ CSS แบบอินไลน์เป็น PDF ภาพขนาด A4, Letter หรือ Legal ภายในเบราว์เซอร์ โดยไม่อัปโหลดซอร์สโค้ดหรือไฟล์ผลลัพธ์

สแกนเอกสารเป็น PDF

เปลี่ยนรูปเอกสาร JPEG, PNG หรือ WebP เป็น PDF ไฟล์เดียวในเบราว์เซอร์ เลือก A4 หรือ US Letter แนวตั้งแล้วดาวน์โหลดโดยไม่อัปโหลดรูปของคุณ.

ดึงภาพจากไฟล์ PDF

ดึงภาพแต่ละภาพที่ฝังอยู่ในไฟล์ PDF ออกมา และดาวน์โหลดแยกกันหรือเป็นไฟล์ ZIP เดียว โดยรักษาความละเอียดเดิมไว้

เครื่องมือนี้มีให้บริการในภาษาอื่น