Просмотр больших CSV/TSV-файлов
Открывайте, фильтруйте, изучайте и экспортируйте очень большие CSV- и TSV-файлы локально благодаря поэтапному разбору и виртуализированной таблице.
Никакие данные не отправляются на сервер
Перетащите сюда CSV- или TSV-файл
Перетащите сюда CSV- или TSV-файл
CSV, TSV или текст с разделителями. Файл останется на этом устройстве.
Обработка выполняется локально в Web Worker. Содержимое файла, фильтры и обнаруженные столбцы никуда не отправляются и не сохраняются.
Настройки импорта
Выберите CSV- или TSV-файл, чтобы создать локальный индекс и просматривать его записи.
Фильтрация записей
Отображаемые и экспортируемые столбцы
Выбранная строка
Выберите строку таблицы, чтобы просмотреть значения ячеек без обрезки.
Содержимое в области просмотра сокращено для сохранения быстродействия страницы; при экспорте значения сохраняются полностью.
Экспорт полного результата
Рекомендуется: добавляет префикс к ячейкам, которые при открытии в электронной таблице могут быть выполнены как формулы, начинающиеся с =, +, - или @.
Защита от формул отключена. Экспортируемый CSV сохраняет исходные значения, но открывать его в редакторе электронных таблиц может быть небезопасно.
При экспорте весь отфильтрованный результат сканируется повторно. Готовый файл всё равно должен целиком поместиться в памяти браузера; размер результата ограничен 512 МиБ.
На этой странице
Инструмент просмотра больших CSV/TSV-файлов открывает файлы с разделителями целиком в браузере. Он поэтапно индексирует записи в Web Worker, а затем отображает лишь небольшую виртуализированную область таблицы. Благодаря этому можно просматривать, фильтровать и выбирать нужные столбцы в файлах, которые намного больше, чем способна обработать обычная HTML-таблица, не отправляя данные в сеть.
Подробное описание функциональности
Обозреватель распознаёт разделители в виде запятой, точки с запятой, табуляции и вертикальной черты, а также позволяет указать разделитель вручную. Поддерживаются поля в кавычках по RFC 4180, удвоенные кавычки, переносы строк внутри полей, UTF-8, текст UTF-16 с прямым или обратным порядком байтов и меткой BOM, а также отдельный режим Latin-1/Windows-1252. Границы фрагментов не влияют на разобранные значения, даже если разделяют многобайтовый символ, пару CRLF или многострочное поле в кавычках.
В памяти остаются только разреженные контрольные точки записей и ограниченный объём данных строк. При фильтрации проверяется каждая запись в выбранных столбцах; доступны поиск подстроки, точное совпадение текста и строгие числовые сравнения. Набор видимых столбцов также определяет, какие столбцы попадут в экспорт. При скачивании CSV или JSONL повторно сканируется весь отфильтрованный результат, а не только отображаемые строки. Защита от формул электронных таблиц включена по умолчанию; отключайте её лишь тогда, когда необходимо сохранить исходные начальные символы формул. Вся обработка выполняется на этом устройстве.
Практические примеры
CSV с запятыми и заголовками: откройте файл со строкой name,amount, за которой следует Ada,12.50; оставьте включёнными автоматическое определение разделителя и параметр заголовка.
TSV без заголовков: выберите табуляцию и отключите параметр заголовка. Обозреватель присвоит столбцам предсказуемые названия, например Column 1.
Многострочное значение в кавычках: `1,"first line
second line" останется одной записью с одной ячейкой. Удвоенная кавычка, например в "He said ""hello""", преобразуется в He said "hello"`.
Безопасный экспорт для электронных таблиц: к значению, начинающемуся с =SUM(A1:A2), по умолчанию добавляется начальный апостроф, предотвращающий выполнение формулы. В JSONL исходная строка сохраняется всегда.
Как использовать этот инструмент
Шаг 1. Настройте импорт
Для обычных CSV-файлов в UTF-8 оставьте автоматическое определение разделителя и кодировки либо явно выберите точку с запятой, табуляцию, вертикальную черту, UTF-16 или Latin-1. Укажите, содержит ли первая запись названия столбцов.
Шаг 2. Откройте файл
Перетащите или выберите один локальный файл. Следите за количеством проиндексированных байтов, прошедшим временем и скоростью обработки. При отмене незавершённый сеанс удаляется; повторный выбор файла запускает индексирование с начала.
Шаг 3. Просматривайте и фильтруйте
Прокручивайте виртуальную таблицу, выбирайте видимые столбцы и строку, чтобы изучить длинные значения. Задайте значение, оператор и столбцы поиска для сканирования всего файла.
Шаг 4. Экспортируйте
Выберите CSV или JSONL, параметры заголовка и BOM и не отключайте защиту от формул электронных таблиц, если исходные значения CSV не являются обязательными. В скачиваемый файл попадут все соответствующие фильтру строки и выбранные столбцы, а не только текущая видимая область.
Советы и лучшие практики
- Для автоматического определения UTF-16 требуется метка порядка байтов; если в файле нет BOM, явно выберите UTF-16 с прямым или обратным порядком байтов.
- Числовые фильтры принимают однозначно записанные десятичные числа и числа с показателем степени и не применяют зависящие от локали правила преобразования. Нечисловые ячейки не соответствуют условиям числового сравнения.
- Пустые заголовки превращаются в
Column N, а повторяющиеся получают предсказуемые числовые суффиксы. Исходные ячейки данных не переименовываются и не преобразуются. - Не отключайте защиту от формул перед открытием CSV в Excel, LibreOffice или другой программе для электронных таблиц. JSONL сохраняет строки и не является форматом формул электронной таблицы.
- Ограничения разбора заданы явно: 2 МиБ на поле, 8 МиБ на запись, 512 столбцов, 100 миллионов записей и 512 МиБ сформированных данных.
- Ограничения браузера на файлы и память продолжают действовать. Фильтрация и экспорт выполняются как повторное сканирование с ограниченным потреблением ресурсов, однако готовый файл для скачивания должен помещаться в памяти браузера.