Eliminar Líneas Duplicadas
Elimina líneas repetidas de tu texto mientras preserva el orden original.
Cómo usar Eliminar Líneas Duplicadas
- 1
Pega tu texto
Introduce o pega en el cuadro de entrada las líneas que quieres limpiar.
- 2
Configura las opciones
Activa o desactiva Distinguir mayúsculas y Recortar espacios en blanco para controlar cómo se comparan las líneas para detectar duplicados.
- 3
Elimina los duplicados
Haz clic en Eliminar duplicados para quitar las líneas repetidas conservando la primera aparición de cada una.
- 4
Copia el resultado
Usa el botón de copiar en la salida para guardar tu texto sin duplicados.
Eliminar líneas duplicadas sin perder el orden
Conservar la primera, descartar el resto
Esta herramienta elimina las líneas repetidas conservando la primera vez que aparece cada línea. A medida que lee de arriba abajo, recuerda cada línea que ya ha visto; cuando una línea vuelve a aparecer, esa copia posterior se descarta. La que sobrevive permanece siempre en su posición original, de modo que la secuencia general de tu texto se conserva con exactitud.
Un ejemplo lo aclara. Dadas las líneas apple, banana, apple, cherry, banana, el resultado es apple, banana, cherry. El segundo apple y el segundo banana se eliminan, pero el orden de las primeras apariciones queda intacto.
Eliminar duplicados sin ordenar
Mucha gente recurre a una hoja de cálculo o a un comando de ordenación en la línea de comandos para eliminar duplicados, pero ordenar revuelve tu orden como efecto secundario. Eso está bien para una lista alfabetizada y es desastroso para cualquier cosa en la que la secuencia tenga significado, como un registro cronológico, una lista de clasificación o los pasos de un proceso. Esta herramienta mantiene el orden precisamente porque nunca ordena.
Si lo que de verdad quieres es una lista única y ordenada, ordena el resultado después. Desacoplar las dos operaciones te da control: elimina primero los duplicados para conservar el orden, u ordena primero si el orden no te importa.
Distinguir mayúsculas, activado o desactivado
Por defecto, la comparación distingue mayúsculas y minúsculas, así que Apple y apple se consideran líneas distintas y se conservan ambas. Desactiva Distinguir mayúsculas y la herramienta las trata como la misma línea, conservando solo la primera. Esto importa constantemente con datos del mundo real, donde el mismo valor aparece con la capitalización mezclada.
Usa la comparación que no distingue mayúsculas cuando estés eliminando duplicados de cosas como direcciones de correo, etiquetas o nombres de usuario, donde '[email protected]' y '[email protected]' deberían contar claramente como uno solo. Mantén la distinción de mayúsculas cuando la capitalización sea significativa, como al distinguir identificadores de código.
Recortar los espacios en blanco antes de comparar
La opción Recortar espacios en blanco ignora los espacios y las tabulaciones iniciales y finales al decidir si dos líneas coinciden. Sin ella, una línea que termina en un espacio final invisible es técnicamente distinta de la misma línea sin él, y ambas sobrevivirían. Con ella, esas líneas casi idénticas se funden en una sola entrada.
Esto detecta la razón más común por la que la eliminación de duplicados parece «pasar por alto» repeticiones obvias: el espacio en blanco invisible. Activar el recorte suele ser lo más acertado cuando tus datos se han reunido a partir de varias fuentes pegadas.
Combinar las dos opciones
La verdadera potencia surge de usar los dos interruptores a la vez. Desactiva la distinción de mayúsculas y activa el recorte, y la herramienta tratará ' Apple ', 'apple' y 'APPLE' como una sola y la misma cosa. Ese es el ajuste más permisivo y tiende a producir la lista de duplicados eliminados más limpia a partir de una entrada desordenada.
A la inversa, si necesitas una eliminación de duplicados estricta y de coincidencia exacta, deja activada la distinción de mayúsculas y desactivado el recorte. La línea debe ser idéntica byte a byte, espacios incluidos, para que se elimine.
Dónde demuestra su utilidad
Entre las tareas típicas se incluyen limpiar una lista de correo para que cada dirección aparezca una sola vez, condensar archivos de registro donde el mismo error se repite cientos de veces, fusionar varias listas en una maestra sin duplicados y ordenar datos exportados antes de importarlos. Dondequiera que tengas valores delimitados por líneas que puedan solaparse, esta herramienta los reduce a un conjunto único.
Como cada entrada se evalúa como una línea completa, brilla en listas de valores cortos, un elemento por fila, más que en la prosa fluida, donde «duplicado» no es un concepto con sentido.
Líneas, no palabras ni frases
Es importante recordar que la unidad de comparación es la línea entera. Dos líneas que comparten una palabra duplicada pero difieren en cualquier otro punto se conservan ambas, porque como líneas completas no son idénticas. Esta herramienta no encuentra palabras ni frases repetidas dentro de un párrafo; funciona estrictamente con líneas completas.
Si tus duplicados todavía no están en líneas propias, sepáralos primero, por ejemplo con Añadir saltos de línea configurado para romper después de una coma, de modo que cada valor caiga en una fila distinta, y luego ejecuta la eliminación de duplicados.
Preguntas frecuentes
¿Conserva el orden original de las líneas?
¿La comparación distingue mayúsculas y minúsculas?
¿Qué hace la opción Recortar espacios en blanco?
¿Qué copia de una línea duplicada se conserva?
¿Se sube mi texto a un servidor?
Herramientas relacionadas
Sigue trabajando con estas prácticas herramientas