ดึงตัวเลขจากข้อความ

เพียงแค่วางข้อมูลต้นทางที่ไม่เป็นระเบียบ เช่น ใบแจ้งหนี้ หน้าผลิตภัณฑ์ที่ดึงข้อมูลมา บันทึกการสนทนา หรือไฟล์ CSV ที่มีคำอธิบายประกอบ ก็จะได้รายการตัวเลขที่สะอาดและครบถ้วนทุกตัว โดยระบบสามารถรู้จำตัวเลขเต็มจำนวน ตัวเลขส่วนทศนิยม ตัวเลขลบ และตัวเลขในรูปแบบสกุลเงินได้เพียงครั้งเดียวผ่านการตรวจสอบด้วย regex ผลลัพธ์จะถูกกำจัดข้อมูลซ้ำ โดยแสดงแต่ละตัวเลขในแต่ละบรรทัด พร้อมใช้งานได้ทันทีในสเปรดชีต เครื่องคิดเลข หรือเครื่องมือสถิติ

วิธีดึงตัวเลขออกจากข้อความ

  1. 1

    วางแหล่งที่มา

    ใส่ข้อความลงไปได้โดยไม่คำนึงถึงความสกปรกของข้อความ, คำที่อยู่รอบข้างและเครื่องหมายวรรคการจะถูกละเลย

  2. 2

    เลือกความแม่นยำ

    เปลี่ยนสถานะของตัวเลือก "รวมค่าทศนิยม" เพื่อจับข้อมูลในรูปแบบ `3.14` หรือปิดตัวเลือกนี้เพื่อดึงเฉพาะค่าจำนวนเต็ม เช่น `42`

  3. 3

    รันโปรแกรมดึงข้อมูล

    ทุกรายการที่ตรงกันจะถูกดึงออกมา เก็บเฉพาะค่าที่ไม่ซ้ำกัน และแสดงจำนวนตัวเลขที่แตกต่างกันทั้งหมดที่พบ

  4. 4

    คัดลอกรายการ

    ตัวเลขหนึ่งชุดต่อแต่ละบรรทัด พร้อมใช้สำหรับการวางลงใน Excel, Numbers หรือเครื่องมืออื่นๆ ที่ทำงานกับคอลัมน์

สิ่งที่ระบบจับคู่สามารถระบุได้

รูปแบบคำสั่ง regex ที่ใช้คือ /-?\d+(?:\.\d+)?/ เมื่อเปิดใช้งานการแสดงตัวเลขทศนิยม และเป็น /-?\d+/ ในกรณีอื่น ซึ่งครอบคลุมรูปแบบตัวเลขทั่วไปได้อย่างครบถ้วน โดยไม่เกิดความคลาดเคลื่อนจากความแตกต่างของแต่ละภูมิภาค

ตัวอย่างของค่าที่จับได้

ข้อมูลนำเข้า ค่าที่จับได้ (เปิดทศนิยม)
ยอดรวมหลังหักภาษี: 1299.99 1299.99
อุณหภูมิลดลงเหลือ -4.5C -4.5
เวอร์ชัน 2.1.3 เปิดตัววันนี้ 2.1, 3
รหัส: 001, 042, 1007 001, 042, 1007
คะแนน: 87% ผ่าน 87

สิ่งที่เครื่องมือไม่ได้จัดการให้

  • ตัวคั่นหลักพัน 1,234.56 จะถูกแยกออกเป็น 1 และ 234.56 หากต้องการเลขเต็มจำนวน ให้ลบตัวคั่นออกก่อน
  • จุดทศนิยมแบบยุโรป (ใช้จุลภาค) 3,14 จะถูกอ่านเป็น 3 และ 14 ให้เปลี่ยนจุลภาคเป็นจุดก่อนการดึงข้อมูล
  • สัญกรณ์วิทยาศาสตร์ 6.02e23 จะคืนค่าเป็น 6.02 และ 23 หากต้องการรูปแบบเลขยกกำลัง ให้แยกวิเคราะห์ข้อมูลต้นฉบับด้วยตนเอง
  • เศษส่วน 1/2 จะกลายเป็น 1 และ 2 ไม่ใช่ 0.5

ขั้นตอนต่อไปที่มีประโยชน์

  • นำรายการไปใช้ในเครื่องมือสถิติเพื่อคำนวณค่าเฉลี่ย ค่ามัธยฐาน และส่วนเบี่ยงเบนมาตรฐาน
  • ใช้ sort | uniq เพื่อจัดเรียงและกำจัดข้อมูลซ้ำ เพื่อหาค่าที่ไม่ซ้ำกันในไฟล์บันทึก
  • เปรียบเทียบผลการดึงข้อมูลสองชุดเคียงข้างกัน เพื่อตรวจหารายการที่ขาดหายไปในใบแจ้งหนี้

คำถามที่พบบ่อย

โปรแกรมจะเพิกเฉยต่อสัญลักษณ์เหล่านี้ และคืนเฉพาะส่วนที่เป็นตัวเลขเท่านั้น ตัวอย่างเช่น $1,299.99 จะกลายเป็น 1 และ 299.99 เนื่องจากเครื่องหมายจุลภาคไม่ถูกใช้เป็นตัวคั่นหลักพัน หากต้องการให้ผลลัพธ์เป็น 1299.99 ในชิ้นเดียว ควรลบเครื่องหมายจุลภาคออกจากข้อมูลต้นทาง

รูปแบบการค้นหาด้วย regex จะจับลำดับตัวเลขอย่างตรงตามต้นฉบับ ดังนั้น 007 จะยังคงเป็น 007 ซึ่งมีความสำคัญเป็นพิเศษเมื่อตัวเลขเหล่านั้นเป็นรหัสประจำตัว รหัสส่วนประกอบ หรือรหัสไปรษณีย์ มากกว่าค่าทางคณิตศาสตร์

โดยค่าเริ่มต้น รายการที่ซ้ำจะถูกลบออกไป เพื่อให้ได้รายการที่สะอาดและชัดเจน หากคุณต้องการข้อมูลลำดับเดิมแบบไม่ปรับเปลี่ยนใดๆ ให้นำแหล่งข้อมูลไปผ่านกระบวนการประมวลผลในรูปแบบคล้าย grep แทน

ข้อความจะถูกประมวลผลภายในคำขอ และจะไม่ถูกจัดเก็บหลังจากได้รับคำตอบ ข้อมูลที่คุณป้อนจะไม่ถูกเก็บไว้ในที่ใดเลย

เครื่องมือที่เกี่ยวข้อง

เครื่องนับคำ

นับคำ ตัวอักษร ประโยค และย่อหน้า พร้อมเวลาในการอ่าน เวลาในการพูด ความหนาแน่นของคีย์เวิร์ด และคะแนนความอ่านง่าย Flesch สำหรับเรียงความ โพสต์ แคปชัน และ meta description

สัญลักษณ์ลูกศรสำหรับคัดลอก

คัดลอกลูกศร Unicode ที่ใช้บ่อยได้ในคลิกเดียว ทั้งแบบตรง สองเส้น ทแยง มีขอ วงกลม และสามเหลี่ยม สำหรับเอกสาร แชต และงานออกแบบ

สัญลักษณ์น้อยกว่าหรือเท่ากับ

คัดลอกสัญลักษณ์ ≤ และสัญลักษณ์เปรียบเทียบทางคณิตศาสตร์ที่เกี่ยวข้อง รวมถึง Unicode เอนทิตี HTML และการเขียน LaTeX สำหรับสเปรดชีต งานวิจัย และหน้าเว็บ

เครื่องแปลงข้อความที่เหมาะกับผู้มีภาวะดิสเล็กเซีย

จัดเรียงข้อความที่วางใหม่เป็นย่อหน้าสั้นๆ และบรรทัดยาวประมาณ 72 ตัวอักษรเพื่อให้อ่านง่ายขึ้น คัดลอกผลลัพธ์ไปวางในเอกสาร อีเมล หรือโปรแกรมแก้ไขใดก็ได้

ตัวสร้างข้อความกลิตช์

สร้างข้อความกลิตช์สไตล์ Zalgo ด้วยเครื่องหมายประกอบ Unicode เลือกระดับความเข้ม ดูรูปแบบต่าง ๆ แล้วคัดลอกข้อความที่ดูเสียหายสำหรับโปรไฟล์ มีม หรือโพสต์สยองขวัญ

ตัวสร้างชื่อผู้ใช้

สร้างไอเดียชื่อผู้ใช้จากคำตั้งต้น พร้อมตัวเลขและตัวคั่นแบบเลือกได้ เหมาะสำหรับบัญชีใหม่ gamertag และโปรไฟล์สำรอง

เครื่องมือนี้มีให้บริการในภาษาอื่น