Hapus Baris Duplikat
Menghapus baris berulang dari teks Anda sambil mempertahankan urutan asli.
Cara menggunakan Hapus Baris Duplikat
- 1
Tempel teks Anda
Masukkan atau tempel baris yang ingin Anda bersihkan ke dalam kotak input.
- 2
Atur opsinya
Aktifkan Case Sensitive dan Trim Whitespace untuk mengontrol bagaimana baris dibandingkan untuk duplikat.
- 3
Hapus duplikat
Klik Remove Duplicates untuk menghapus baris yang berulang sambil menyimpan kemunculan pertama dari masing-masing.
- 4
Salin hasilnya
Gunakan tombol salin pada output untuk menyimpan teks Anda yang telah dideduplikasi.
Menghapus Duplikat Baris Tanpa Kehilangan Urutan
Pertahankan yang pertama, buang sisanya
Alat ini menghapus baris yang berulang sambil mempertahankan kemunculan pertama setiap baris. Saat membaca dari atas ke bawah, ia mengingat setiap baris yang sudah dilihatnya; ketika sebuah baris muncul lagi, salinan berikutnya itu dibuang. Baris yang bertahan selalu berada di posisi aslinya, sehingga keseluruhan urutan teks Anda terjaga persis.
Sebuah contoh memperjelasnya. Diberikan baris apple, banana, apple, cherry, banana, keluarannya adalah apple, banana, cherry. Kemunculan kedua apple dan kedua banana dihapus, tetapi urutan kemunculan pertama tidak tersentuh.
Menghapus duplikat tanpa mengurutkan
Banyak orang meraih spreadsheet atau perintah sort di baris perintah untuk menghapus duplikat, tetapi pengurutan mengacak urutan Anda sebagai efek samping. Itu tidak masalah untuk daftar yang diurutkan secara alfabetis dan menjadi bencana untuk apa pun yang urutannya membawa makna, seperti log kronologis, daftar berperingkat, atau langkah-langkah dalam sebuah proses. Alat ini menjaga urutan justru karena ia tidak pernah mengurutkan.
Jika Anda memang menginginkan daftar yang terurut dan unik, urutkan keluarannya setelahnya. Memisahkan kedua operasi itu memberi Anda kendali: hapus duplikat dulu untuk menjaga urutan, atau urutkan dulu jika urutan tidak penting bagi Anda.
Kepekaan huruf besar/kecil, aktif atau nonaktif
Secara default perbandingannya peka huruf besar/kecil, sehingga Apple dan apple dianggap sebagai baris yang berbeda dan keduanya dipertahankan. Nonaktifkan Case Sensitive dan alat ini memperlakukan keduanya sebagai baris yang sama, hanya menyimpan yang pertama. Hal ini terus-menerus penting pada data dunia nyata di mana nilai yang sama muncul dengan kapitalisasi campuran.
Gunakan pencocokan tanpa peka huruf besar/kecil ketika Anda menghapus duplikat hal-hal seperti alamat email, tag, atau nama pengguna, di mana '[email protected]' dan '[email protected]' jelas seharusnya dihitung sebagai satu. Pertahankan kepekaan huruf besar/kecil ketika kapitalisasi bermakna, seperti membedakan pengenal kode.
Memangkas whitespace sebelum membandingkan
Opsi Trim Whitespace mengabaikan spasi dan tab di awal dan akhir saat memutuskan apakah dua baris cocok. Tanpanya, sebuah baris yang berakhir dengan spasi tak terlihat di ujungnya secara teknis berbeda dari baris yang sama tanpa spasi itu, dan keduanya akan bertahan. Dengannya, baris-baris yang nyaris identik itu menyatu menjadi satu entri.
Ini menangkap alasan paling umum mengapa penghapusan duplikat tampak 'melewatkan' pengulangan yang jelas: whitespace tak terlihat. Mengaktifkan trim biasanya merupakan pilihan yang tepat ketika data Anda dirakit dari beberapa sumber tempelan.
Menggabungkan kedua opsi
Kekuatan sesungguhnya muncul dari menggunakan kedua sakelar secara bersamaan. Nonaktifkan kepekaan huruf besar/kecil dan aktifkan pemangkasan, maka alat ini akan memperlakukan ' Apple ', 'apple', dan 'APPLE' sebagai satu dan sama. Itu adalah pengaturan yang paling longgar dan cenderung menghasilkan daftar bebas duplikat yang paling bersih dari masukan yang berantakan.
Sebaliknya, jika Anda membutuhkan penghapusan duplikat yang ketat dan sama persis, biarkan kepekaan huruf besar/kecil tetap aktif dan pemangkasan nonaktif. Baris harus identik bita demi bita, termasuk spasinya, untuk bisa dihapus.
Di mana alat ini membuktikan kegunaannya
Tugas yang lazim mencakup membersihkan milis agar setiap alamat muncul sekali, memadatkan berkas log di mana galat yang sama berulang ratusan kali, menggabungkan beberapa daftar menjadi satu daftar induk tanpa duplikat, dan merapikan data hasil ekspor sebelum diimpor. Di mana pun Anda memiliki nilai yang dipisah baris yang mungkin tumpang tindih, alat ini memadatkannya menjadi satu himpunan yang unik.
Karena setiap entri dinilai sebagai satu baris utuh, alat ini bersinar pada daftar nilai-nilai pendek, satu item per baris, alih-alih pada prosa mengalir di mana 'duplikat' bukanlah konsep yang bermakna.
Baris, bukan kata atau frasa
Penting untuk diingat bahwa unit perbandingannya adalah seluruh baris. Dua baris yang berbagi satu kata yang sama tetapi berbeda di bagian lain mana pun keduanya dipertahankan, karena sebagai baris utuh keduanya tidak identik. Alat ini tidak mencari kata atau kalimat yang berulang di dalam sebuah paragraf; ia bekerja ketat pada baris penuh.
Jika duplikat Anda belum berada pada barisnya masing-masing, pisahkan dulu, misalnya dengan Add Line Breaks yang diatur untuk memenggal setelah koma, agar setiap nilai mendarat pada baris terpisah, lalu jalankan penghapusan duplikatnya.
Pertanyaan yang sering diajukan
Apakah alat ini mempertahankan urutan baris asli?
Apakah perbandingannya peka huruf besar/kecil?
Apa fungsi opsi Trim Whitespace?
Salinan mana dari baris duplikat yang dipertahankan?
Apakah teks saya diunggah ke server?
Alat terkait
Lanjutkan dengan alat praktis ini