Resumen: el CSV parece el formato de datos más simple posible, y es exactamente por eso que pequeñas inconsistencias — una coma perdida dentro de un campo de texto sin comillas, un delimitador incompatible, un BOM oculto — hacen fallar una importación o desalinean silenciosamente las columnas. Combina esta guía con Encoding Converter, Duplicate Finder, Remove Extra Spaces y Character Counter.
Las reglas reales del CSV están definidas en RFC 4180, aunque en la práctica la mayoría del CSV real solo las sigue vagamente — que es exactamente la fuente de la mayoría de los problemas de importación.
Dónde fallan realmente las importaciones CSV
El problema central: una coma es a la vez el delimitador de columna y un carácter que puede aparecer legítimamente dentro de un campo de texto (una dirección, una descripción de producto con "Pequeño, Mediano, Grande" dentro). La respuesta de RFC 4180 es el entrecomillado — un campo que contiene una coma debe estar rodeado de comillas dobles, y una comilla doble literal dentro de un campo entrecomillado se escapa duplicándola (""). El software que exporta CSV sin seguir esta regla produce archivos donde una sola coma sin comillas desplaza silenciosamente cada columna siguiente una posición.
Los delimitadores no son universales
Separado por comas es la suposición predeterminada, pero muchos archivos reales usan punto y coma en su lugar — particularmente común en configuraciones regionales donde la coma ya es el separador decimal de los números, lo que hace ambiguo reutilizarla como delimitador de columna. Un CSV que se abre como una sola columna sin dividir en una hoja de cálculo muy a menudo simplemente está usando el delimitador equivocado para la suposición de esa herramienta, no está realmente roto.
Codificación y el BOM invisible
Una marca de orden de bytes (BOM) UTF-8 — tres bytes invisibles al principio de un archivo — es añadida por algunas herramientas (notablemente Excel al exportar) para señalar la codificación, pero no todos los parsers la eliminan automáticamente. Si se deja, puede adjuntarse invisiblemente al nombre del encabezado de la primera columna, así que una búsqueda de una columna llamada literalmente name falla porque el encabezado real es name con un carácter invisible antepuesto — un error genuinamente difícil de detectar a simple vista.
Un flujo de limpieza previo a la importación
- Abre primero el archivo crudo como texto plano (no en una hoja de cálculo, que interpreta automáticamente y puede ocultar la estructura real) para verificar el delimitador y entrecomillado reales.
- Verifica los primeros bytes en busca de un BOM si las búsquedas por nombre de columna fallan misteriosamente.
- Busca específicamente comas sin comillas dentro de lo que deberían ser campos de texto únicos — la causa más común de desalineación de columnas.
- Verifica un salto de línea final o una fila vacía final, que algunas herramientas de importación cuentan como un registro final roto.
- Ejecuta Duplicate Finder en una columna clave (como un ID o email) antes de importar si registros duplicados causarían problemas más adelante.
Errores comunes que evitar
- Asumir que todo CSV usa comas — los archivos delimitados por punto y coma son comunes y se ven idénticos hasta que intentas dividir en el carácter equivocado.
- Editar CSV en una app de hoja de cálculo, que reformatea silenciosamente fechas, elimina ceros a la izquierda, y puede recodificar texto de formas que no coinciden con el original.
- No verificar un BOM inicial cuando las búsquedas basadas en encabezados fallan sin razón visible.
- Ignorar comas sin comillas dentro de campos de texto libre hasta que la importación produzca columnas visiblemente desplazadas.
La mayoría de los fallos de importación CSV no se tratan realmente de los datos — se tratan de las suposiciones de un parser (delimitador, codificación, entrecomillado) que no coinciden con lo que el archivo realmente contiene.