เครื่องมือตรวจข้อความ Mojibake
การเปรียบเทียบแบบส่วนตัวนี้ใช้ไม่ได้แล้ว
เปิดเครื่องมือฉบับเต็มหน้าเดียววางข้อความที่ดูเสียหาย
วางข้อความอย่าง café หรือข้อความภาษาญี่ปุ่นที่อ่านไม่ได้หลังใช้รหัสอักขระไม่ตรงกัน ข้อความเดิมในช่องแก้ไขจะไม่เปลี่ยนแปลง
สูงสุด 50,000 อักขระ เครื่องมือนี้เปรียบเทียบเฉพาะข้อความ Unicode ที่วางเท่านั้น ไม่ตรวจสอบหรือซ่อมไฟล์ สตรีมไบต์ ฐานข้อมูล หรือส่วนหัว HTTP
Mojibake คือข้อมูลที่แสดงเป็นอักขระผิดเพราะไบต์ถูกถอดรหัสด้วยชุดอักขระที่เข้ากันไม่ได้ ตัวอย่างที่พบบ่อยคือ café ซึ่งเกิดเมื่อ café ถูกเข้ารหัสเป็น UTF-8 แต่ไบต์กลับถูกตีความเป็น Latin-1 หรือ Windows-1252 วางข้อความที่มองเห็นเพื่อเปรียบเทียบสมมติฐานการกู้ข้อความที่แปลงย้อนกลับได้อย่างเคร่งครัด เครื่องมือจะเก็บข้อความเดิมไว้ ระบุทุกตัวเลือกว่าเป็นสมมติฐาน และดำเนินการเปรียบเทียบภายในเบราว์เซอร์ของคุณ
วิธีเปรียบเทียบสมมติฐานการกู้ข้อความ mojibake
-
1
วางข้อความที่มองเห็น
ใช้ข้อความตรงตามที่ได้รับ เครื่องมือจะไม่อัปโหลดหรือตรวจสอบไฟล์ต้นฉบับ
-
2
ยินยอมให้เปรียบเทียบ
ให้เบราว์เซอร์ทดสอบการตีความไบต์แบบ Latin-1 และ Windows-1252 ด้วยตัวถอดรหัส UTF-8 แบบเคร่งครัด
-
3
เปรียบเทียบโดยไม่ด่วนสรุป
อ่านข้อความเดิมที่ไม่เปลี่ยนแปลงเทียบกับทุกตัวเลือกแบบย้อนกลับได้ แล้วเลือกเมื่อบริบทสนับสนุนเท่านั้น
-
4
นำไปใช้เป็นข้อความธรรมดา
คัดลอก ดาวน์โหลด หรือพิมพ์สมมติฐานที่เลือกโดยไม่เขียนทับข้อความเดิม
สมมติฐานการกู้ข้อความบอกอะไรได้และบอกอะไรไม่ได้
รหัสอักขระกำหนดความสัมพันธ์ระหว่างอักขระกับไบต์ UTF-8 แทน é ด้วยสองไบต์ C3 A9 หากซอฟต์แวร์ถอดรหัสไบต์เหล่านั้นเป็น Windows-1252 หรือ ISO-8859-1 ผลที่เห็นอาจกลายเป็น é สมมติฐานที่มีประโยชน์จะย้อนความผิดพลาดเฉพาะนี้ โดยถือว่าอักขระแบบเก่าที่มองเห็นคือค่าไบต์ ถอดรหัสไบต์เหล่านั้นเป็น UTF-8 อย่างเคร่งครัด แล้วตรวจว่าการเข้ารหัสตัวเลือกกลับเป็น UTF-8 ให้ไบต์ชุดเดิมหรือไม่
การตรวจสอบแบบไปกลับจะปฏิเสธลำดับ UTF-8 ที่ไม่สมบูรณ์หรือผิดรูป รวมทั้งตัวเลือกที่มีอักขระทดแทน � เพราะข้อมูลส่วนนั้นสูญหายไปแล้ว แต่ผลที่แปลงไปกลับได้เป็นเพียงหลักฐานของสมมติฐาน ไม่ใช่ข้อพิสูจน์ว่าระบบต้นทางใช้รหัสอักขระใดหรือผู้เขียนตั้งใจเขียนอะไร
| ข้อความที่เห็น | สมมติฐานที่ทดสอบ | ตัวเลือกที่เป็นไปได้ | สิ่งที่ต้องตรวจสอบ |
|---|---|---|---|
café |
ไบต์ UTF-8 ถูกอ่านเป็น Latin-1 | café |
เทียบการสะกดกับต้นฉบับ |
It’s |
ไบต์ UTF-8 ถูกอ่านเป็น Windows-1252 | It’s |
ตรวจเครื่องหมายวรรคตอนและรูปแบบเอกสาร |
æååã |
ไบต์ UTF-8 ถูกอ่านเป็น Latin-1 | 文字化け |
เทียบภาษาญี่ปุ่นกับสำเนาที่เชื่อถือได้ |
café |
เกิดข้อผิดพลาดด้านรหัสอักขระต่อเนื่องสองครั้ง | café |
ตรวจทั้งสองรอบที่มีเงื่อนไข |
เหตุใดข้อความภาษาญี่ปุ่นจึงต้องใช้บริบท
เมื่อไบต์ UTF-8 ของภาษาญี่ปุ่นถูกถอดรหัสผ่านชุดอักขระเก่าที่ไม่ถูกต้อง ข้อความอาจกลายเป็นส่วนผสมยาวของอักษรละติน สัญลักษณ์ และอักขระที่ดูคล้ายรหัสควบคุม การแปลงย้อนกลับได้ช่วยจำกัดตัวเลือก แต่ชื่อสั้นหรืออักขระเดี่ยวก็ยังตีความได้หลายแบบ โปรดเทียบตัวเลือกกับเอกสารต้นฉบับ แหล่งส่งออกฐานข้อมูล ผู้ส่ง หรือสำเนาอ้างอิงอื่นที่เชื่อถือได้
ข้อจำกัดและการกู้คืนที่ปลอดภัยกว่า
เครื่องมือนี้รับข้อความ Unicode ที่เบราว์เซอร์ถอดรหัสแล้ว จึงกู้ไบต์ที่สูญหายก่อนหน้านี้ไม่ได้ ระบุรหัสอักขระจากไฟล์ไบนารีไม่ได้ ซ่อมคอลัมน์ฐานข้อมูลไม่ได้ และเปลี่ยนส่วนหัว HTTP Content-Type ไม่ได้ หากไม่มีตัวเลือก ให้เก็บข้อความเดิมไว้ เมื่อทำได้ ให้หาไบต์ต้นฉบับจริง สำรองข้อมูล ตรวจทั้งรหัสอักขระที่ประกาศและที่ใช้จริง แล้วถอดรหัสให้ถูกต้องเพียงครั้งเดียวด้วยเครื่องมือสำหรับไฟล์หรือสตรีมไบต์ อย่าบันทึกข้อความเสียหายทับสำเนาต้นฉบับเพียงชุดเดียวซ้ำ ๆ
คำถามที่พบบ่อย
ไม่ใช่ ผลนั้นหมายถึงการตีความไบต์แบบเก่ารายการหนึ่งถอดรหัสเป็น UTF-8 ที่ถูกต้องและแปลงกลับเป็นไบต์เดิมได้พอดี การตีความหลายแบบอาจให้ข้อความที่เหมือนกันหรือต่างกันแต่ดูอ่านได้ จึงยังต้องอาศัยบริบทและแหล่งข้อมูลอ้างอิง
อักขระที่เห็นอาจไม่ได้มาจากไบต์ UTF-8 ที่ถูกอ่านผิดเป็น ISO-8859-1 หรือ Windows-1252 ลำดับอาจไม่สมบูรณ์ หรืออักขระทดแทนอาจทำให้ข้อมูลสูญหายแล้ว โปรดเก็บข้อความเดิมไว้และตรวจไบต์จริงกับข้อมูลรหัสอักขระ
ไม่ได้ เครื่องมือเปรียบเทียบเฉพาะข้อความ Unicode ที่วางเท่านั้น ไม่อ่านไฟล์ ตรวจจับรหัสอักขระของไฟล์ เชื่อมต่อฐานข้อมูล เขียนค่าที่บันทึกใหม่ หรือซ่อมส่วนหัวเซิร์ฟเวอร์ โปรดสำรองต้นฉบับก่อนใช้ขั้นตอนแปลงระดับไบต์
ไม่ การเปรียบเทียบ การเลือกตัวเลือก การคัดลอก การสร้าง TXT และการเตรียมพิมพ์เกิดขึ้นในเบราว์เซอร์ โหมด Funnel อาจเก็บระเบียนที่ตรวจสอบแล้วในแท็บนี้ได้นานถึง 30 นาที และ URL มีเฉพาะรหัสงานที่ไม่เปิดเผยข้อมูล
เครื่องมือที่เกี่ยวข้อง
เครื่องสร้างตัวย่อ
สร้างตัวย่อจากวลี ชื่อโปรเจกต์ หรือหัวข้อ เลือกความยาวและโทน แล้วคัดชื่อที่ออกเสียงง่ายและจำได้จริง
เครื่องสลับตัวอักษรในคำ
สลับตัวอักษรในแต่ละคำโดยคงตัวแรกและตัวสุดท้ายไว้ เหมาะสำหรับปริศนา เกมคำศัพท์ และแบบฝึกอ่าน
เครื่องมือตรวจไวยากรณ์ภาษาอังกฤษ
ตรวจไวยากรณ์และการสะกดภาษาอังกฤษแบบรวดเร็ว: ตรวจจับคำสะกดผิดที่พบบ่อย อะพอสทรอฟีที่หายไปในคำย่อ และคำที่พิมพ์ซ้ำ
ตัวสร้างบรรณานุกรม
สร้างรายการบรรณานุกรมที่จัดรูปแบบถูกต้องใน APA 7, MLA 9, Chicago 17 และ Harvard รองรับหนังสือ วารสาร เว็บไซต์ ภาพยนตร์ และอื่นๆ
เครื่องสร้างชื่อแฟนตาซี
สร้างชื่อตัวละครแฟนตาซีตามเผ่าพันธุ์ คลาส และโทนเพศ สำหรับแคมเปญ D&D การสร้างโลก นิยาย และรายชื่อ NPC
ตัวสร้างคำแบบสุ่ม
สร้างรายการคำภาษาอังกฤษแบบสุ่ม เลือกคำทั่วไป ธรรมชาติ สร้างสรรค์ หรือเทคโนโลยี ตั้งค่าความยาวและจำนวน แล้วคัดลอกผลลัพธ์