Desduplicador CSV
Opciones
¿Qué es un deduplicador CSV?
Un deduplicador CSV le ayuda a eliminar filas duplicadas de un archivo CSV o de texto CSV pegado.
Esto es útil para limpiar exportaciones, eliminar correos electrónicos o ID repetidos, preparar importaciones y simplificar conjuntos de datos antes de su posterior procesamiento.
Cómo utilizar el deduplicador CSV
- Pegue su CSV en el campo de entrada.
- Elija el delimitador o utilice la detección automática.
- Opcionalmente, seleccione un nombre de columna o índice si desea eliminar duplicados en un solo campo.
- Elija si desea conservar el primer o el último duplicado y luego haga clic en Eliminar duplicados.
Consejos
- Si no se selecciona ninguna columna, la detección de duplicados funciona en toda la fila.
- Al deduplicar por una columna concreta, recuerda que la primera columna es el índice 0.
- Utilice valores de recorte cuando las exportaciones CSV contengan espacios adicionales.
- Ignorar mayúsculas y minúsculas es útil cuando los valores difieren solo en mayúsculas y minúsculas.
Guías relacionadas
Aprenda el workflow detrás de esta herramienta y qué revisar después.
Comprobaciones de deduplicación CSV antes de eliminar registros repetidos
Los duplicados dependen de la clave de negocio elegida. Dos filas idénticas y dos registros de la misma entidad no siempre son el mismo problema.
Elige la clave
Usa identificadores estables o una combinación deliberada de columnas en vez de deduplicar todos los campos por defecto.
Normaliza con cuidado
Decide si mayúsculas, espacios exteriores, formato telefónico, acentos y ceros iniciales son diferencias significativas.
Elige el registro conservado
Define si debe conservarse el primero, último, más reciente, más completo u otro registro preferido.
Audita el resultado
Registra la cantidad eliminada, inspecciona grupos de ejemplo y conserva la fuente para revertir una regla demasiado amplia.
Herramientas relacionadas
Estas herramientas también pueden resultarle útiles.