Explorador de archivos CSV/TSV grandes

Abre, filtra, examina y exporta archivos CSV o TSV muy grandes de forma local mediante análisis incremental y una tabla virtualizada.

No se envían datos al servidor

Suelta aquí un archivo CSV o TSV

Suelta aquí un archivo CSV o TSV

CSV, TSV o texto delimitado. El archivo permanece en este dispositivo.

El procesamiento se realiza localmente en un Web Worker. El contenido del archivo, los filtros y las columnas detectadas nunca se suben ni se guardan.

Ajustes de importación

Explorador

Elige un archivo CSV o TSV para crear un índice local y explorar sus registros.

En esta página

El Explorador de archivos CSV/TSV grandes abre archivos delimitados íntegramente en el navegador. Indexa los registros de forma incremental en un Web Worker y después solo muestra una pequeña ventana virtualizada. Así puedes examinar, filtrar y seleccionar columnas de archivos mucho mayores de lo que una tabla HTML normal puede manejar, sin subir los datos.

Funcionalidad detallada

El explorador reconoce separadores de coma, punto y coma, tabulación y barra vertical, y también permite elegir uno de forma explícita. Admite campos entrecomillados según RFC 4180, comillas duplicadas, saltos de línea integrados, UTF-8, texto UTF-16 little-endian y big-endian con BOM y un modo Latin-1/Windows-1252 explícito. Los límites entre bloques no alteran los valores analizados, incluso cuando dividen un carácter multibyte, un par CRLF o un campo multilínea entrecomillado.

Solo se conservan puntos de control dispersos de los registros y una cantidad limitada de datos de las filas. El filtrado recorre todos los registros de las columnas seleccionadas y permite buscar subcadenas, coincidencias exactas de texto y comparaciones numéricas estrictas. La visibilidad de las columnas también determina qué columnas se exportan. Las descargas CSV y JSONL vuelven a recorrer todo el resultado filtrado, en lugar de exportar únicamente las filas visibles. La protección frente a fórmulas de hojas de cálculo está activada de forma predeterminada; desactívala solo si necesitas conservar los caracteres iniciales de fórmula sin modificar. Todo el procesamiento permanece en este dispositivo.

Ejemplos prácticos

CSV separado por comas con encabezados: abre name,amount seguido de Ada,12.50; mantén activadas la detección automática del separador y la opción de encabezado.

TSV sin encabezados: elige Tabulación y desactiva la opción de encabezado. El explorador asignará nombres deterministas como Column 1.

Valor multilínea entrecomillado: `1,"first line

second line" se conserva como un solo registro y una sola celda. Una comilla duplicada como en "He said ""hello""" se convierte en He said "hello"`.

Exportación segura para hojas de cálculo: un valor que comienza por =SUM(A1:A2) se exporta de forma predeterminada con un apóstrofo inicial, lo que impide ejecutar la fórmula. JSONL siempre conserva la cadena original.

Cómo usar esta herramienta

  1. Configura la importación

    Mantén la detección automática del separador y la codificación para archivos CSV UTF-8 habituales, o selecciona de forma explícita punto y coma, tabulación, barra vertical, UTF-16 o Latin-1. Indica si el primer registro contiene los nombres de las columnas.

  2. Abre el archivo

    Suelta o elige un archivo local. Observa los bytes indexados, el tiempo transcurrido y la velocidad de procesamiento. Al cancelar se elimina la sesión parcial; si vuelves a elegir el archivo, se inicia un índice nuevo.

  3. Explora y filtra

    Desplázate por la tabla virtual, elige las columnas visibles y selecciona una fila para examinar valores más largos. Introduce un valor, un operador y las columnas de búsqueda para recorrer el archivo completo.

  4. Exporta

    Elige CSV o JSONL, las opciones de encabezado y BOM, y mantén activada la protección frente a fórmulas de hojas de cálculo salvo que sea imprescindible conservar los valores CSV originales. La descarga exporta todas las filas coincidentes y las columnas seleccionadas, no solo el área visible en ese momento.

Consejos y mejores prácticas

  • La detección automática de UTF-16 requiere una marca de orden de bytes; elige explícitamente UTF-16 little-endian o big-endian si el archivo no tiene BOM.
  • Los filtros numéricos aceptan texto decimal o exponencial inequívoco y no aplican conversiones numéricas dependientes de la configuración regional. Las celdas no numéricas no cumplen las comparaciones numéricas.
  • Los encabezados vacíos se convierten en Column N; los duplicados reciben sufijos numéricos deterministas. Las celdas de datos originales no se renombran ni se convierten.
  • Mantén activada la protección frente a fórmulas antes de abrir el CSV exportado en Excel, LibreOffice u otra aplicación de hojas de cálculo. La salida JSONL conserva las cadenas y no es un formato de fórmulas de hoja de cálculo.
  • Los límites de análisis son explícitos: 2 MiB por campo, 8 MiB por registro, 512 columnas, 100 millones de registros y 512 MiB de salida generada.
  • Los límites del navegador para archivos y memoria siguen vigentes. El filtrado y la exportación son recorridos repetidos con recursos acotados, pero la descarga terminada debe caber en la memoria del navegador.