DataDock

Quitar duplicados de un CSV

Elige la columna (o columnas) que identifica cada fila, como el SKU o el código, y DataDock elimina las repetidas. Te quedas con la primera de cada clave y ves cuántas se quitaron.

Antes: el SKU «A» y el «B» están repetidos
sku,nombre,precio
A,Uno,1
B,Dos,2
A,Uno repetido,9
C,Tres,3
B,Dos otra vez,8
Después: clave «sku»
sku,nombre,precio
A,Uno,1
B,Dos,2
C,Tres,3

Cómo funciona

  1. Sube el CSV.
  2. En «Duplicados», marca la columna o columnas que forman la clave.
  3. La vista previa te dice cuántas filas se eliminan.
  4. Descarga el CSV sin repetidas.

Preguntas frecuentes

¿Qué fila se conserva?

La primera que aparece en el fichero. Las siguientes con la misma clave se eliminan.

¿Puedo usar varias columnas como clave?

Sí. La combinación de todas ellas es la clave: dos filas son duplicadas solo si coinciden en todas.

¿Distingue mayúsculas de minúsculas?

Por defecto sí; marca «Sin distinguir mayúsculas» para que «ab» y «AB» cuenten como la misma clave.

¿Qué pasa con las filas sin clave?

Si todas las celdas de la clave están vacías, la fila no se considera duplicada de ninguna otra y se conserva.

¿Y con millones de filas?

Solo se guarda una huella de cada clave, unos 60 bytes. En nuestras pruebas, 2 millones de claves distintas usaron unos 126 MB de memoria.