Explorador de archivos CSV/TSV grandes
Abre, filtra, examina y exporta archivos CSV o TSV muy grandes de forma local mediante análisis incremental y una tabla virtualizada.
No se envían datos al servidor
Suelta aquí un archivo CSV o TSV
Suelta aquí un archivo CSV o TSV
CSV, TSV o texto delimitado. El archivo permanece en este dispositivo.
El procesamiento se realiza localmente en un Web Worker. El contenido del archivo, los filtros y las columnas detectadas nunca se suben ni se guardan.
Ajustes de importación
Elige un archivo CSV o TSV para crear un índice local y explorar sus registros.
Filtrar registros
Columnas visibles y exportadas
Fila seleccionada
Selecciona una fila de la tabla para examinar los valores de las celdas sin recortes.
La inspección en pantalla se ha acortado para preservar la capacidad de respuesta de la página; las exportaciones conservan los valores completos.
Exportar el resultado completo
Recomendado: añade un prefijo a las celdas que podrían ejecutarse como fórmulas iniciadas por =, +, - o @ al abrirlas en una hoja de cálculo.
La protección frente a fórmulas está desactivada. El CSV exportado conserva los valores originales, pero puede no ser seguro abrirlo en un programa de hojas de cálculo.
La exportación vuelve a recorrer todo el resultado filtrado. El navegador debe conservar la descarga terminada en memoria; el resultado está limitado a 512 MiB.
En esta página
El Explorador de archivos CSV/TSV grandes abre archivos delimitados íntegramente en el navegador. Indexa los registros de forma incremental en un Web Worker y después solo muestra una pequeña ventana virtualizada. Así puedes examinar, filtrar y seleccionar columnas de archivos mucho mayores de lo que una tabla HTML normal puede manejar, sin subir los datos.
Funcionalidad detallada
El explorador reconoce separadores de coma, punto y coma, tabulación y barra vertical, y también permite elegir uno de forma explícita. Admite campos entrecomillados según RFC 4180, comillas duplicadas, saltos de línea integrados, UTF-8, texto UTF-16 little-endian y big-endian con BOM y un modo Latin-1/Windows-1252 explícito. Los límites entre bloques no alteran los valores analizados, incluso cuando dividen un carácter multibyte, un par CRLF o un campo multilínea entrecomillado.
Solo se conservan puntos de control dispersos de los registros y una cantidad limitada de datos de las filas. El filtrado recorre todos los registros de las columnas seleccionadas y permite buscar subcadenas, coincidencias exactas de texto y comparaciones numéricas estrictas. La visibilidad de las columnas también determina qué columnas se exportan. Las descargas CSV y JSONL vuelven a recorrer todo el resultado filtrado, en lugar de exportar únicamente las filas visibles. La protección frente a fórmulas de hojas de cálculo está activada de forma predeterminada; desactívala solo si necesitas conservar los caracteres iniciales de fórmula sin modificar. Todo el procesamiento permanece en este dispositivo.
Ejemplos prácticos
CSV separado por comas con encabezados: abre name,amount seguido de Ada,12.50; mantén activadas la detección automática del separador y la opción de encabezado.
TSV sin encabezados: elige Tabulación y desactiva la opción de encabezado. El explorador asignará nombres deterministas como Column 1.
Valor multilínea entrecomillado: `1,"first line
second line" se conserva como un solo registro y una sola celda. Una comilla duplicada como en "He said ""hello""" se convierte en He said "hello"`.
Exportación segura para hojas de cálculo: un valor que comienza por =SUM(A1:A2) se exporta de forma predeterminada con un apóstrofo inicial, lo que impide ejecutar la fórmula. JSONL siempre conserva la cadena original.
Cómo usar esta herramienta
Configura la importación
Mantén la detección automática del separador y la codificación para archivos CSV UTF-8 habituales, o selecciona de forma explícita punto y coma, tabulación, barra vertical, UTF-16 o Latin-1. Indica si el primer registro contiene los nombres de las columnas.
Abre el archivo
Suelta o elige un archivo local. Observa los bytes indexados, el tiempo transcurrido y la velocidad de procesamiento. Al cancelar se elimina la sesión parcial; si vuelves a elegir el archivo, se inicia un índice nuevo.
Explora y filtra
Desplázate por la tabla virtual, elige las columnas visibles y selecciona una fila para examinar valores más largos. Introduce un valor, un operador y las columnas de búsqueda para recorrer el archivo completo.
Exporta
Elige CSV o JSONL, las opciones de encabezado y BOM, y mantén activada la protección frente a fórmulas de hojas de cálculo salvo que sea imprescindible conservar los valores CSV originales. La descarga exporta todas las filas coincidentes y las columnas seleccionadas, no solo el área visible en ese momento.
Consejos y mejores prácticas
- La detección automática de UTF-16 requiere una marca de orden de bytes; elige explícitamente UTF-16 little-endian o big-endian si el archivo no tiene BOM.
- Los filtros numéricos aceptan texto decimal o exponencial inequívoco y no aplican conversiones numéricas dependientes de la configuración regional. Las celdas no numéricas no cumplen las comparaciones numéricas.
- Los encabezados vacíos se convierten en
Column N; los duplicados reciben sufijos numéricos deterministas. Las celdas de datos originales no se renombran ni se convierten. - Mantén activada la protección frente a fórmulas antes de abrir el CSV exportado en Excel, LibreOffice u otra aplicación de hojas de cálculo. La salida JSONL conserva las cadenas y no es un formato de fórmulas de hoja de cálculo.
- Los límites de análisis son explícitos: 2 MiB por campo, 8 MiB por registro, 512 columnas, 100 millones de registros y 512 MiB de salida generada.
- Los límites del navegador para archivos y memoria siguen vigentes. El filtrado y la exportación son recorridos repetidos con recursos acotados, pero la descarga terminada debe caber en la memoria del navegador.