Remove Duplicate Rows
remove_duplicate_rows · duplicates · any
2026-09-23
กำลังประมวลผล…
remove_duplicate_rows · duplicates · any
2026-09-23
เทคนิคนี้ลบเฉพาะแถวที่ค่าทุกคอลัมน์เหมือนกัน ค่า null ต่างจากข้อความว่าง และตัวเลขต่างจากข้อความตัวเลข หากต้องการถือว่าอีเมลเดียวกันคือคนเดียวกันแม้ช่องอื่นต่างกัน ให้ใช้ Remove Duplicate By Column
โค้ดด้านล่างแสดงโหมด keep first แบบเปรียบเทียบตรงตัวบนตารางที่มีคอลัมน์เหมือนกัน ไม่เปิด ignoreCase/ignoreWhitespace ค่า null และ "" จึงไม่ถูกยุบรวม การลบยังย้อนกลับได้ด้วย Undo
| Parameter | Type | Default |
|---|---|---|
keep | first | last | max_completeness | "first" |
ignoreCase | boolean | false |
ignoreWhitespace | boolean | false |
import json
rows = [{'name': 'A', 'city': 'ไทย'}, {'name': 'A', 'city': 'ไทย'}, {'name': None, 'city': ''}, {'name': '', 'city': ''}]
columns = ['name', 'city']
seen = set()
result = []
for row in rows:
key = json.dumps([row.get(column) for column in columns], ensure_ascii=False)
if key not in seen:
seen.add(key)
result.append(dict(row))
assert len(result) == 3
print(json.dumps(result, ensure_ascii=False))
ไฟล์รายชื่อมี 3 แถว โดยสองแถวแรกเหมือนกันทั้งหมด เลือก keep first แล้ว Preview ต้องรายงานลบ 1 แถว เหลือ 2 แถว ตรวจ Before/After และรหัสลูกค้าก่อนดาวน์โหลด โดยเฉพาะเมื่อเปิด ignoreCase
Trim Whitespace ช่วยจัดช่องว่างก่อนเทียบ ส่วน Remove Duplicate By Column ใช้เมื่อต้องการระบุ key เอง Detect Null Like ทำให้ความหมายของค่าที่หายไปสม่ำเสมอก่อนตรวจซ้ำ