Saltar al contenido principal

Eliminar duplicados y conservar la primera o la última fila: ¿cuál elegir?

No se sube nadaProbado hasta 500 MB

¿Hay que conservar la primera o la última fila duplicada? Aprende qué significa cada opción, cómo decide el orden del archivo el resultado y cómo verificarlo.

Publicado: 2026-08-28Actualizado: 2026-09-085 minElige primera o última en la herramienta de duplicados
Ilustración del flujo de datos para «Eliminar duplicados y conservar la primera o la última fila: ¿cuál elegir?»

Conserva el primer duplicado cuando la primera fila coincidente del archivo sea la versión en la que confías; conserva el último cuando la versión fiable sea la última fila coincidente. La elección sigue el orden del archivo, así que si debe ganar el registro más nuevo o el más antiguo, ordena primero el archivo para que esa versión aparezca al principio o al final antes de eliminar duplicados.

Qué significan realmente aquí «primera» y «última»

Las opciones siguen las filas de arriba abajo. «Conservar primera» mantiene la primera coincidencia. «Conservar última» mantiene la última.

Por eso importa el orden actual. Si quieres conservar la fila más nueva o la más antigua, ordena primero el archivo para colocar la fila correcta arriba o abajo de cada grupo de duplicados.

Abre el archivo antes de decidir. Lee la primera y la última fila de un grupo de duplicados.

«Conservar primera fila» y «Conservar última fila» solo miran dónde aparecen las filas coincidentes de arriba abajo. No eligen por fecha ni por otro campo. Revisa al menos un grupo de duplicados antes de descargar.

Cuándo «conservar primera» es la elección correcta

Conservar primera es correcto cuando la fila más antigua del archivo lleva los datos en los que confías. Casos habituales: exportaciones de solo anexado en las que la exportación anterior es el original y la posterior es una instantánea; registros que nunca se corrigieron in situ, donde la fila original es la canónica; archivos ordenados de más antiguo a más nuevo donde la entrada más antigua es el registro de referencia. En cada caso, la copia más antigua es la verdad, y «conservar primera» descarta el ruido.

Cuándo «conservar última» es la elección correcta

Conservar última es correcto cuando la fila más reciente del archivo es la que sustituye a las anteriores. Casos habituales: exportaciones de sincronización de CRM o de producto donde las filas posteriores son correcciones o versiones enriquecidas de filas anteriores; reimportaciones de una hoja editada en la que la exportación más reciente refleja el estado actual; archivos ordenados de más antiguo a más nuevo donde la entrada más reciente es la canónica. En cada caso, la copia más reciente es la verdad, y «conservar última» descarta las entradas obsoletas.

Establecer el orden del archivo antes de deduplicar

La herramienta no decide qué duplicado es más nuevo o mejor. Solo sigue el orden actual de las filas. Tres comprobaciones ayudan a usar ese orden de forma segura.

Abre el archivo y confirma el orden. Antes de elegir primera o última, desplázate hasta un grupo de duplicados y lee la primera y la última fila una al lado de la otra. Si la primera fila lleva los datos en los que confías, conservar primera es lo correcto; si la última los lleva, conservar última es lo correcto. Si ninguna parece canónica, el orden del archivo no te está diciendo qué copia conservar, y la herramienta tampoco puede hacerlo — no tiene vista de ninguna columna distinta de la clave.

Ordena deliberadamente cuando el orden de exportación sea desconocido. Muchos CRM, ERP y exportaciones de bases de datos ordenan por un ID interno o por una marca de tiempo de última modificación que no coincide con la columna que te interesa. Si el sistema de origen no garantiza un orden estable y significativo, ordena primero el archivo por la columna clave en una hoja de cálculo, en la dirección que coloque la copia canónica arriba (para conservar primera) o abajo (para conservar última). El orden es lo que da significado a primera y última; una exportación sin orden convierte ambas opciones en suposiciones.

Vigila un orden de exportación inestable entre ejecuciones. Un archivo exportado hoy a partir de la misma consulta que produjo el de ayer puede no tener el mismo orden de filas. Si deduplicas la nueva exportación y las asignaciones de primera/última ya no coinciden con las del archivo antiguo, la diferencia está en el orden de exportación, no en un cambio de los datos. Vuelve a ordenar ambos archivos por la columna clave antes de compararlos, o ancla el orden con una columna secundaria que no cambie entre ejecuciones.

Sin un orden conocido, primera y última son la fila que haya caído arriba o abajo del archivo de origen. La herramienta no puede recuperar lo canónico de un archivo que no codifica lo canónico en su posición.

Cuándo ninguna opción es la correcta

Si la primera y la última fila de un grupo de duplicados parecen idénticas salvo por una columna que no incluiste en la clave, la deduplicación está tratando las columnas equivocadas como identidad. Dos filas de cliente pueden compartir correo electrónico pero diferir en last_login_date — el correo es la clave, y la fila con el inicio de sesión más reciente es la canónica, pero la herramienta solo puede elegir por orden de archivo. Es una señal de que la columna clave no identifica por sí sola un registro estable. Añade una segunda columna a la clave, o reconsidera si el correo es realmente único.

Patrón de archivoConservar primeraConservar última
Exportación de solo anexado, sin ordenarGana la exportación más antiguaGana la exportación más reciente
Ordenado de más antiguo a más nuevo por fechaGana el registro más antiguoGana el registro más reciente
Ordenado de más nuevo a más antiguo por fechaGana el registro más reciente (contra la intención)Gana el registro más antiguo (contra la intención)
Hoja reimportada, editada in situGana la fila previa a la ediciónGana la fila editada
Sin ordenar y sin certezaInspecciona primero un grupoInspecciona primero un grupo

"(Contra la intención)" marca celdas donde el nombre de la opción y el resultado por fecha apuntan en direcciones opuestas para un archivo ordenado por fecha: la fila que sobrevive no es la fila que sugiere el nombre de la opción para esa dirección de orden.

Un ejemplo desarrollado

Se exportó una lista de contactos, se editó en una hoja de cálculo para corregir una errata en la columna de empresa y se volvió a exportar bajo el mismo nombre de archivo. La primera fila de cada grupo de duplicados es la versión previa a la edición; la última fila es la versión posterior a la edición.

contacts-before-dedupe.csv — grupo de duplicados en orden de archivo

email, name, companyalex@example.com, Alex, Acmealex@example.com, Alex, Acme Corpsam@example.com, Sam, Betasam@example.com, Sam, Beta Inc

Con conservar última, sobreviven las filas posteriores a la edición:

contacts-deduped-keep-last.csv — filas editadas conservadas

email, name, companyalex@example.com, Alex, Acme Corpsam@example.com, Sam, Beta Inc

La misma entrada exacta con conservar primera habría producido la versión previa a la edición. Ambas opciones son correctas para un archivo distinto.

  1. 01

    Inspecciona un grupo de duplicados.

    Encuentra un grupo de duplicados y compara la primera y la última fila una al lado de la otra. La que lleva los datos en los que confías es la que hay que conservar.

  2. 02

    Elige Conservar primera fila o Conservar última fila.

    Conservar primera mantiene la primera coincidencia de arriba abajo. Conservar última mantiene la última. Ordena antes el archivo si quieres que decida la fecha.

  3. 03

    Revisa los grupos de duplicados y la vista previa limpia.

    Antes de descargar, mira los grupos de duplicados que muestra la herramienta. Si una fila conservada no es la que esperabas, cambia a la otra opción y vuelve a ejecutar — el archivo de origen no se toca.

  4. 04

    Descarga el archivo limpio y las filas eliminadas.

    Se escriben los dos archivos: las filas deduplicadas y un archivo aparte con todo lo filtrado. Abre el archivo de filas eliminadas una vez para confirmar que no se descartó ninguna fila crítica.

  5. 05

    Vuelve a ejecutar si te equivocaste.

    Vuelve a ejecutar con la otra opción y compara los dos archivos limpios; la diferencia son exactamente las filas en las que el orden importó.

Después de la deduplicación, pasa el archivo limpio por el reparador de CSV si tiene filas irregulares o líneas en blanco sueltas, o por el mapeador de columnas CSV si necesitas renombrar columnas para el sistema receptor. La herramienta de duplicados corrige la identidad; el reparador corrige la estructura; el mapeador corrige el nombrado.

Elige primera o última en la herramienta de duplicados

Mira la transformación

Los registros repetidos se convierten en un archivo limpio y revisable.

Las filas repetidas se eliminan del archivo limpio y siguen siendo fáciles de revisar.

Entrada
1042,alex@example.com,Pro
1043,sam@example.com,Gratis
1048,alex@example.com,ProDuplicado
Resultado
1042,alex@example.com,Pro
1043,sam@example.com,Gratis

✓ El archivo limpio conserva una copia