Распознавание УПД вернуло пустые строки: 5 причин и что делать
Пустые строки в распознанном УПД чаще всего означают, что сервис получил не текстовый, а изображённый документ: скан без текстового слоя, фото со смартфона или PDF с защитой от копирования. Реже причина — слабый сервер, который обрывает обработку по таймауту в пиковые часы, или макет документа, не совпадающий с типовой формой УПД.
🔍 Почему распознавание УПД возвращает пустые строки
Бухгалтер закрывает месяц: тридцать УПД от разных поставщиков, сканер в углу офиса, сервис распознавания открыт в соседней вкладке браузера. Первые пять документов проходят чисто — суммы, номенклатура, НДС на месте. Шестой открывается пустым: реквизиты есть, а строк табличной части нет ни одной. Кажется, что сломался сервис, но чаще ломается не он, а вход — тот файл, который в него загрузили.
Скан без текстового слоя
МФУ сохраняет документ как картинку, а не как текст с координатами символов. Глазами страница читается свободно, но программе распознавания извлекать нечего — она видит пиксели, а не буквы. Если сканер настроен на «фото» или «изображение» вместо «документ» либо OCR, результат предсказуем: реквизиты в шапке заполнены, а строки таблицы — нет.
Разрешение ниже 200 dpi и кривые страницы
При закрытии месяца документы сканируют пачками, без проверки каждой страницы. Разрешение падает до 150 dpi, лист ложится в лоток под углом, цифры в таблице сжимаются до нечитаемых символов. Программа находит шапку — она крупная и стабильно расположена, — но не может разобрать мелкий текст в строках и возвращает их пустыми. Порог, ниже которого распознавание таблиц становится ненадёжным, — примерно 200 dpi; комфортный запас даёт 300 dpi.
PDF с защитой от копирования
Часть поставщиков присылает УПД в PDF с запретом на копирование текста — так настроена выгрузка из их учётной системы. Файл открывается и печатается без проблем, но сервис распознавания не может извлечь содержимое: защита блокирует именно то действие, которое ему нужно для работы.
Сервер захлёбывается в пиковые часы
Но иногда с файлом всё в порядке, а строки всё равно пустые. Если распознавание работает на слабом или перегруженном сервере, в момент закрытия месяца — когда десятки документов идут один за другим, — обработка обрывается по таймауту. Сервис успевает прочитать шапку, но не успевает разобрать таблицу целиком, поэтому отдаёт документ с частично или полностью пустыми строками.
Макет УПД не похож на типовую форму
Крупный поставщик может использовать собственный шаблон УПД: сдвинутые колонки, объединённые ячейки, нестандартный шрифт. Программа опознаёт, что перед ней УПД, но не может сопоставить структуру таблицы с логикой распознавания — отсюда пустые строки при в целом читаемом и качественном файле.
Причины и решения одним взглядом
| Причина | Как проявляется | Что делать | Сложность исправления |
|---|---|---|---|
| Скан без текстового слоя | Все строки таблицы пустые, шапка распознана | Пересканировать в режиме OCR или «документ» | Низкая |
| Разрешение ниже 200 dpi | Часть цифр в таблице теряется или искажается | Пересканировать на 300 dpi без наклона страницы | Низкая |
| PDF защищён от копирования | Файл открывается, но текст не извлекается | Запросить открытый PDF у поставщика | Средняя |
| Сервер перегружен в пиковые часы | Строки обрываются по таймауту при закрытии месяца | Перенести обработку на выделенный сервер | Средняя |
| Нестандартный макет УПД поставщика | Документ опознан, но таблица не сопоставляется | Донастройка шаблона распознавания | Высокая, нужна доработка |
Пустые строки — не разовая неприятность. Бухгалтер вручную переносит суммы из тридцати документов вместо того, чтобы проверять расхождения, рабочее время уходит на рутину, а если ошибка проскочит в проводку — НДС к вычету разойдётся с оригиналом, и расхождение всплывёт только на сверке. Особенно заметно это перед сдачей отчётности: если НДС к вычету по УПД разошёлся с оригиналом из-за одной пропущенной строки, расхождение находят не бухгалтеры, а инспектор при сверке — и объяснять его приходится по каждому документу отдельно. Для бизнеса это часы работы бухгалтерии и риск ошибки в отчёте, а не просто «программа не сработала».
🛠 Как исправить, если распознавание вернуло пустые строки
Прежде чем переделывать весь процесс, стоит пройти по файлу, который не распознался, — обычно причина видна за пару минут.
- ✓Открыть исходный PDF и попробовать выделить текст мышью в табличной части. Не выделяется — файл без текстового слоя, нужен пересканированный вариант с распознаванием текста прямо в сканере.
- ✓Проверить разрешение скана: на 300 dpi таблица распознаётся почти всегда, ниже 200 dpi возможны пропуски цифр.
- ✓Убедиться, что PDF не защищён от копирования — если защита есть, запросить у поставщика открытую версию файла.
- ✓Загрузить документ повторно в спокойное время, не в пиковые часы закрытия месяца: если строки появились, дело было в нагрузке на сервер, а не в файле.
- ✓Если ни один пункт не помог, отправить файл в поддержку сервиса распознавания вместе с примером пустого результата.
Для компаний, где УПД приходят и по почте, и на бумаге, и через ЭДО, проще держать один канал загрузки — например, загрузку PDF в 1С, которая проверяет файл на текстовый слой ещё до того, как он уйдёт в распознавание.
🔁 Что делать, если ошибка повторяется
Если пустые строки появляются не на одном документе, а на пачке файлов от одного и того же поставщика, дело не в конкретном скане, а в системе, которая эти файлы формирует.
Проверить источник документов
Стоит спросить у поставщика, как он готовит УПД: печатает и сканирует вручную или выгружает PDF напрямую из своей учётной системы. Прямая выгрузка почти всегда содержит текстовый слой и распознаётся стабильно; ручное сканирование — источник большинства пустых строк.
Смотреть на пометку об ошибке, а не только на пустое поле
У большинства сервисов распознавания в истории операций рядом с документом есть техническая пометка: «нет текстового слоя», «превышено время обработки», «не удалось сопоставить шаблон». Эта строка почти всегда точнее описывает причину, чем визуальный осмотр скана, и экономит время на переборе вариантов из предыдущего раздела.
Проверить нагрузку на своей стороне
Если распознавание крутится на офисном компьютере или на сервере, который одновременно тянет базу 1С, отчёты и терминальные сессии сотрудников, в пиковые часы ему может не хватать ресурсов именно на разбор таблиц — самой тяжёлой части документа. Симптом узнаваем: шапка распознаётся всегда, строки — через раз, и чаще всего в те дни, когда нагрузка на базу выше обычной. Если такие провалы совпадают по времени с моментами, когда бухгалтерия одновременно закрывает месяц и формирует акты сверки, а системный администратор видит рост нагрузки на процессор именно в эти часы, — это подтверждает версию с сервером, а не с файлами.
Когда нужна доработка, а не пересканирование
Если поставщик присылает УПД по нестандартному макету регулярно — раз в неделю, каждый месяц, — переделывать сканирование каждый раз не вариант. Здесь помогает точечная доработка 1С: шаблон распознавания донастраивают под конкретный макет один раз, и дальше документы этого поставщика проходят так же чисто, как типовые.
🛡 Как предотвратить пустые строки при распознавании УПД
Профилактика дешевле, чем пересканирование пачки документов в последний день месяца.
Стандартизировать сканирование
Один режим для всех документов: 300 dpi, чёрно-белый текст, распознавание включено в самом МФУ. Минута на настройку сканера экономит часы на пересканировании и ручном вводе задним числом.
Договориться с поставщиками о формате PDF
Если контрагент выгружает УПД из своей учётной системы, стоит один раз обсудить формат без запрета на копирование — разговор на пять минут снимает проблему для этого поставщика навсегда.
Завести чек-лист перед закрытием месяца
Перед пиковыми днями стоит проверить: сканер настроен на OCR, документы от постоянных поставщиков приходят в открытом PDF, а обработка не пересекается по времени с закрытием периода в 1С. Три пункта закрывают большинство причин из списка выше ещё до того, как документы попадут в очередь на распознавание.
💰 Когда дело не в файле, а в сервере: что это значит для бизнеса
Самая частая скрытая причина повторяющихся пустых строк — не файлы, а железо, на котором крутится обработка вместе с остальной 1С. Системные требования к серверу для стабильной работы 1С описаны в официальной документации, и если сервер им не соответствует, тормозит не только распознавание, но и закрытие месяца, отчёты, работа терминальных пользователей.
Мы разворачиваем распознавание УПД на выделенном сервере — оно не делит ресурсы с базой 1С и терминальными сессиями бухгалтерии, поэтому не обрывается по таймауту в пиковые часы. Сама услуга распознавания УПД из скана стоит от 3900 руб/мес. Если причина в слабом сервере, отдельно можно арендовать сервер для 1С от 1 100 ₽/мес за пользователя — актуальные конфигурации и цены собраны на странице тарифов. Если помимо распознавания нужна разовая настройка — перенос базы, донастройка шаблона под нестандартный макет, — такие работы считаются отдельно: сопровождение 1С и работа системного администратора стоят от 3800 руб/час.
❓ Частые вопросы
Почему распознанный УПД показывает суммы, но не показывает строки товаров?
Обычно это скан без текстового слоя — сканер сохранил документ как картинку, шапку сервис ещё может распознать по общим признакам, а мелкий текст таблицы без текстового слоя разобрать не может. Решение — пересканировать документ в режиме OCR или «документ» с разрешением от 300 dpi.
Можно ли распознать УПД, если поставщик закрыл PDF от копирования?
Напрямую нет — защита блокирует именно извлечение текста, которое нужно сервису распознавания. Стоит запросить у поставщика открытую версию файла или снять ограничение через редактор PDF перед загрузкой; печатная копия проблему не решает, так как теряет текстовый слой при сканировании.
Почему распознавание УПД срабатывает через раз в один и тот же день месяца?
Похоже на нагрузку сервера в момент закрытия месяца, когда десятки документов загружаются подряд и обработка обрывается по таймауту. Решение — перенести распознавание на выделенный сервер, который не делит ресурсы с базой 1С и терминальными сессиями бухгалтерии.
Сколько стоит подключить распознавание УПД, чтобы не разбираться с пустыми строками вручную?
Услуга распознавания УПД из скана у нас стоит от 3900 руб/мес и включает проверку файла перед обработкой. Если проблема в слабом сервере, отдельно можно арендовать сервер для 1С от 1 100 ₽/мес за пользователя — точная конфигурация подбирается под объём документов.
Что делать, если у поставщика нестандартный макет УПД и распознавание регулярно не видит строки?
Разовое пересканирование не поможет — макет остаётся прежним. Нужна точечная доработка шаблона распознавания под структуру таблицы этого поставщика; после настройки документы такого макета распознаются так же стабильно, как типовые.
Или позвоните: +7 906 045-28-27 — в рабочее время с 9:00 до 19:00
Остались вопросы? Нужна помощь?
Менеджеры компании с радостью ответят на ваши вопросы, произведут расчет стоимости услуг и подготовят индивидуальное коммерческое предложение.
Бесплатная консультация

