Comparar dos archivos sucios

Encuentra filas que faltan, duplicados, valores cambiados y coincidencias aproximadas.

Archivo A
Suelta aquí el archivo A
CSV, TSV, TXT o XLSX
Archivo B
Suelta aquí el archivo B
CSV, TSV, TXT o XLSX

Cómo funciona Comparar

Suelta dos archivos. MessyMatch los lee en tu navegador, normaliza los valores con las reglas de limpieza que elijas (espacios, mayúsculas, tildes, ceros a la izquierda, caracteres invisibles) y genera un diff indexado en segundos. Los datos originales no se modifican. El valor normalizado se usa sólo para emparejar.

  1. Carga el archivo A y el archivo B (CSV, TSV, TXT, XLSX o texto pegado).
  2. Elige comparación por fila completa o por columna clave, y marca las reglas de limpieza.
  3. Opcionalmente activa la coincidencia aproximada para ver casi-coincidencias con motivo (tilde, mayúsculas, errata, palabras en otro orden).
  4. Pulsa Comparar. El motor construye un índice hash y recorre los dos archivos en paralelo.
  5. Revisa las siete secciones: sólo en A, sólo en B, en ambos, duplicados en A, duplicados en B, filas cambiadas y casi-coincidencias. Exporta cualquiera como CSV o XLSX.

Para qué se compara un archivo con otro

Comparar existe para los casos en los que las fórmulas de Excel se quedan cortas: valores sucios, archivos grandes, dos sistemas que deberían cuadrar y no cuadran.

  • Reconciliar dos exportaciones del mismo conjunto

    Una exportación de CRM y otra del ERP de los mismos clientes, dos capturas de base de datos, la semana pasada vs ésta. Encuentra qué se ha movido, qué ha desaparecido y qué está duplicado.

  • Migrar datos entre sistemas

    Comprueba que han pasado todas las filas. Suelta el export origen y el destino, compara por clave primaria, arregla las filas que falten antes de pasar a producción.

  • Reconciliar listas con texto sucio

    Nombres de cliente con espacios extra, DNIs con ceros a la izquierda, emails con mayúsculas mezcladas. Las reglas de limpieza normalizan ambos lados antes de emparejar.

  • Encontrar duplicados dentro de un archivo

    Compara un archivo consigo mismo por columna clave. Los duplicados se reportan en una sección aparte para que los elimines antes de re-importar.

  • Sustituto de BUSCARV y BUSCARX

    Dos columnas, dos archivos, sin fórmulas. El diff se lee más rápido que una columna llena de #N/A y detecta casi-coincidencias que BUSCARV se traga sin avisar.

Preguntas frecuentes sobre Comparar

¿Suben mis archivos al servidor?+

No. El análisis y la comparación se ejecutan en tu navegador dentro de un Web Worker. El servidor sólo ve metadatos (número de filas, tamaño, formato) que usamos para aplicar los límites antiabuso.

¿Qué formatos admite?+

CSV, TSV, TXT, XLSX y texto pegado. Los Excel por encima de 100.000 filas pueden ir lentos porque XLSX es un XML zipeado. Para volúmenes muy grandes, exporta a CSV primero.

¿Qué diferencia hay entre comparar por fila completa y por columna clave?+

Por fila completa: la fila entera es la unidad de emparejamiento. Por columna clave: emparejas por la columna que elijas y se reportan los cambios en el resto. Usa columna clave siempre que tengas un identificador estable.

¿Qué es una casi-coincidencia?+

Dos filas que comparten clave pero difieren en otro campo tras normalizar, o dos filas cuyas claves se parecen (errata, tilde, palabras en otro orden). Cada casi-coincidencia trae un motivo para que tú decidas qué hacer.

¿Cuánto cuesta?+

Gratis para archivos de hasta 2.000 filas cada uno. Por encima, el precio depende del archivo mayor: 3 $ hasta 25k, 7 $ hasta 100k, 15 $ hasta 500k, 29 $ hasta 1M. Pago único, sin suscripción.

¿Puedo comparar archivos con columnas en distinto orden?+

Sí. En el modo columna clave las columnas se emparejan por nombre. También puedes mapearlas a mano si los nombres son distintos entre los dos archivos.