CSV, PDF или XLSX: как формат банковской выписки влияет на импорт
Когда вы выгружаете выписку из банка, формат файла, который вам достаётся, - это не просто техническая деталь: именно он определяет, сколько работы останется, прежде чем эти данные превратятся в пригодный для использования бюджет. Одни форматы отдают вам чистые структурированные данные. Другие - нечто, что изначально задумывалось только для печати.
Что на самом деле содержит каждый формат
Одна и та же история операций - четыре совершенно разные отправные точки:
| Формат | Что это такое на самом деле | Насколько хорошо он импортируется |
|---|---|---|
| CSV / TXT | Простые строки структурированных данных - одна строка на операцию, столбцы для даты, суммы и описания | Автоматически, как только распознана структура столбцов, либо после однократной настройки сопоставления для нового банка |
| XLS / XLSX | Та же структура, что и у CSV, только внутри файла таблицы с настоящей строкой заголовков | Автоматически для распознанной структуры банка - тот же принцип, что и у CSV, просто другой контейнер |
| Готовый к печати документ - визуально оформленный для человеческого глаза, а не рассчитанный на разбор машиной | Требует парсера под конкретный банк, который читает реальную вёрстку его выписки, поскольку у PDF нет встроенной структуры | |
| OFX / QFX, CAMT.053, QIF | Стандартизированные форматы банковских данных, изначально созданные для импорта в финансовые программы | Автоматически для любого банка, который их предоставляет, - без какой-либо доработки под конкретный банк |
Почему PDF стоит особняком
Файл CSV - это прежде всего данные, и лишь во вторую очередь - что-то читаемое человеком. Выписка в PDF устроена наоборот: она создаётся, чтобы хорошо выглядеть при печати или просмотре, а даты, суммы и описания расположены там, куда их поместил шаблон конкретного банка, - иногда аккуратными столбцами, иногда с переносом на несколько строк, а иногда вперемешку с текущими остатками и постраничными итогами среди настоящих операций.
Именно поэтому для выписок в PDF нужен парсер под конкретный банк, а не универсальный: чтобы прочитать такую выписку, нужно понимать именно ту визуальную вёрстку, которую использует данный банк, - вплоть до того, какие строки являются операциями, а какие заголовками, футерами или итоговым остатком. Home Budget Analytics распознаёт PDF-выписки для целого ряда банков поимённо - именно потому, что вёрстка каждого из них была один раз вручную изучена и размечена.
Если ваш банк пока не распознаётся автоматически
Если выгрузка CSV или TXT вашего банка не совпадает с уже известной структурой, это не тупик, а разовая настройка. Вы просто указываете, какой столбец - дата, какой - сумма, а какой - описание, и приложение запоминает это сопоставление для всех будущих выписок этого же банка. Настроить нужно всего один раз, и дальше этот банк ведёт себя точно так же, как и автоматически распознаваемый.
Если вы не уверены, какой формат выгрузить на сайте или в приложении банка, CSV обычно самый безопасный вариант для начала - это самый распространённый способ выгрузки, и после однократной настройки сопоставления он же самый надёжный для импорта в дальнейшем.
Начните бесплатный период уже сегодня
14 дней бесплатно и без банковской карты - зарегистрируйтесь и загрузите свою первую выписку, чтобы увидеть всё своими глазами.
Начать бесплатный период