大型 CSV/TSV 浏览器
在本地打开、筛选、检查和导出超大型 CSV 或 TSV 文件,并通过增量解析和虚拟化表格保持流畅操作。
没有数据发送到服务器
将 CSV 或 TSV 文件拖放到此处
将 CSV 或 TSV 文件拖放到此处
支持 CSV、TSV 或其他分隔文本。文件始终保留在此设备上。
所有处理均在 Web Worker 中本地完成。文件内容、筛选条件和检测到的列绝不会上传或保存。
导入设置
请选择一个 CSV 或 TSV 文件,在本地建立索引并浏览其中的记录。
筛选记录
显示和导出的列
所选行
请选择表格中的一行,以检查未截断的单元格值。
为保持页面响应流畅,屏幕上的检查内容已缩短;导出时仍会保留完整值。
导出完整结果
建议启用:为可能在电子表格中作为以 =、+、- 或 @ 开头的公式执行的单元格添加前缀。
公式防护已关闭。导出的 CSV 会保留原始值,但使用电子表格软件打开时可能存在安全风险。
导出时会重新扫描全部筛选结果。浏览器仍需在内存中容纳最终下载内容;输出上限为 512 MiB。
本页内容
大型 CSV/TSV 浏览器完全在您的浏览器中打开分隔文件。它通过 Web Worker 为记录逐步建立索引,并且只显示一个小型虚拟化窗口,因此无需上传数据,即可检查、筛选大型文件并选择所需列;这类文件的规模可以远超普通 HTML 表格的处理能力。
详细功能
本浏览器可识别逗号、分号、制表符和竖线分隔符,也允许您明确指定一种分隔符。它支持 RFC 4180 带引号字段、双写引号、字段内换行、UTF-8、带 BOM 的 UTF-16 小端序和大端序文本,以及明确指定的 Latin-1/Windows-1252 模式。即使数据块边界将多字节字符、CRLF 组合或带引号的多行字段拆开,也不会改变解析结果。
系统仅保留稀疏的记录检查点和有界的行数据。筛选会扫描所选列中的每一条记录,支持子字符串、完全匹配文本和严格数值比较。列的可见性同时决定导出哪些列。下载 CSV 和 JSONL 时会重新扫描完整筛选结果,而不是仅导出当前可见的行。电子表格公式防护默认启用;只有在必须保留原始值开头的公式字符时才应将其关闭。所有处理始终在此设备上进行。
实用示例
带表头的逗号分隔 CSV: 打开内容为 name,amount,下一行为 Ada,12.50 的文件;保持自动检测分隔符并启用表头选项。
不带表头的 TSV: 选择“制表符”并关闭表头选项。浏览器会分配 Column 1 等确定性名称。
带引号的多行值: `1,"first line
second line" 会保留为一条记录中的一个单元格。"He said ""hello""" 这样的双写引号会解析为 He said "hello"`。
安全导出到电子表格: 对于以 =SUM(A1:A2) 开头的值,默认会在导出时添加前置撇号,从而阻止公式执行。JSONL 始终保留原始字符串。
如何使用此工具
选择导入设置
对于普通的 UTF-8 CSV 文件,请保留自动检测分隔符和编码;也可以明确选择分号、制表符、竖线、UTF-16 或 Latin-1。设置首条记录是否包含列名。
打开文件
拖放或选择一个本地文件。您可以查看已建立索引的字节数、耗时和处理速度。取消操作会销毁未完成的会话;重新选择文件将从头建立全新索引。
浏览和筛选
滚动虚拟表格、选择要显示的列,并选择一行以检查较长的值。输入值、运算符和搜索列,即可扫描整个文件。
导出
选择 CSV 或 JSONL,并配置表头和 BOM 选项。除非必须保留原始 CSV 值,否则请保持启用电子表格公式防护。下载内容包含所有匹配行和所选列,而不只是当前视口中的内容。
提示和最佳实践
- 自动检测 UTF-16 需要字节顺序标记;如果文件没有 BOM,请明确选择 UTF-16 小端序或大端序。
- 数值筛选接受含义明确的十进制或指数形式文本,不会采用特定区域设置的数字强制转换规则。非数值单元格不会匹配数值比较。
- 空白表头会变为
Column N;重复表头会添加确定性的数字后缀。原始数据单元格不会被重命名或转换。 - 使用 Excel、LibreOffice 或其他电子表格软件打开 CSV 输出前,请保持启用公式防护。JSONL 输出会保留字符串,并非电子表格公式格式。
- 解析限制均有明确规定:每个字段 2 MiB、每条记录 8 MiB、512 列、1 亿条记录,以及 512 MiB 的生成输出。
- 浏览器的文件和内存限制仍然适用。筛选和导出均采用有界的重新扫描方式,但最终下载内容必须能够装入浏览器内存。