ИИ ИИшка Про
Гайды
П

Как проверить цифры после распознавания скана: рабочий маршрут без слепого доверия OCR

Редакция ИИШКА Про
Иллюстрация к материалу: Как проверить цифры после распознавания скана: рабочий маршрут без слепого доверия OCR

Скан счёта может выглядеть идеально и всё равно дать ошибочную цифру после распознавания. OCR путает 0 и 8, теряет запятую, переносит значение из соседней колонки или не замечает маленькое «без НДС». Самая опасная ситуация — когда итоговая таблица аккуратна и человеку не хочется снова открывать исходник. Поэтому цель этого гайда не «получить текст из PDF», а сохранить доказуемую связь между каждым важным полем и его местом на исходной странице. Разберём процесс на пачке из 20 счетов; для договора или лабораторного результата контроль нужно ужесточать отдельно.

Шаг 1. Определите, что считается важным

До загрузки файлов выпишите поля: номер документа, дата, контрагент, сумма, валюта, налог и номер страницы. Укажите допустимые форматы. Например, дата может быть записана словом, а отрицательная сумма — в скобках. Не поручайте модели «вытащить всё полезное»: так получится разная структура по разным файлам и вы потеряете возможность проверить полноту. Для каждого поля добавьте состояние «не найдено» и «неразборчиво». Пустое поле предпочтительнее уверенной догадки. Если значение взято из расчёта, а не прямо из документа, это должно быть отдельное вычисляемое поле.

Разделите документы на обычные и критичные. Ошибка в названии внутренней категории может стоить минуты исправления, ошибка в банковском счёте или сумме — денег и времени на разбирательство. Критичные поля всегда проверяются человеком, даже если инструмент показал высокую уверенность. Согласуйте это правило с владельцем процесса до запуска. Иначе экономия времени превратится в спор о том, кто должен был заметить разницу после отправки платежа.

Шаг 2. Подготовьте изображение, но сохраните оригинал

Сохраните исходный файл неизменным и дайте ему уникальный идентификатор. Если снимок перекошен или затемнён, подготовьте отдельную улучшенную копию, но не заменяйте оригинал. Убедитесь, что край страницы не обрезал итоговую сумму и подпись. Для цифрового PDF сначала проверьте, нет ли внутри готового текстового слоя: повторное OCR может ухудшить качество по сравнению с извлечением исходного текста. Для фото спросите, читаются ли мелкие символы на обычном масштабе. Если нет, модель не должна выдавать уверенный результат.

Не отправляйте бухгалтерские документы в неизвестный веб-сервис из удобства. Проверьте договорные условия обработки, срок хранения и права сотрудников. Локальное OCR снижает одну категорию риска, но требует настройки зависимостей и доступа. Сравнение локального и облачного распознавания поможет выбрать маршрут по типу данных, а не по рекламному обещанию точности.

Шаг 3. Попросите поле и доказательство

Для каждой строки будущего реестра сохраняйте идентификатор файла, номер страницы, название поля, извлечённое значение, фрагмент текста вокруг него и область изображения. Некоторые инструменты умеют отдавать координаты блоков. У LightOnOCR-3-4B такой режим заявлен разработчиком; у других систем структура устроена иначе. Если координат нет, сохраните хотя бы страницу и ближайшую цитату. Не позволяйте модели ссылаться на несуществующую страницу: проверьте, что идентификатор действительно входит в документ.

Следите за таблицами. В строке может быть сумма за единицу, сумма по позиции и общий итог; внешне они похожи. Задача извлечения должна называть, какое именно значение требуется, а оператор — видеть заголовок столбца. Для многостраничных счетов проверьте продолжение таблицы и перенос итогов. Если распознаватель разбил ячейку на две строки, автоматический реестр может выглядеть правдоподобно, но потерять десятки и сотни.

Шаг 4. Сделайте независимую арифметику

Числа, которые можно пересчитать, пересчитайте отдельным кодом или обычной формулой, а не вторым ответом той же модели. Сумма позиций, скидка, налог и итог должны сходиться с учётом правил округления. Укажите допустимое расхождение и валюту. Если на документе указаны разные ставки налога, не применяйте одну ко всем строкам. Спорную запись переводите в ручную очередь с причиной: «итог не сходится», «нечитаемый символ», «неясный заголовок», «нет страницы». Это быстрее, чем перечитывать весь пакет без объяснения.

Сделайте выборочный двойной контроль и для документов без явных противоречий. Например, второй сотрудник независимо сверяет все платежные реквизиты и 10% некритичных полей. Ведите журнал исправлений с исходным значением, новым значением, человеком и причиной. Такой журнал покажет, какие типы страниц требуют улучшения. Если ошибок много на фото с бликами, не нужна очередная модель — нужен другой способ съёмки.

Шаг 5. Проверяйте итог до передачи дальше

Выведите таблицу так, чтобы ссылка на исходную страницу открывалась в один клик. Не экспортируйте непроверенные поля в платёжную систему. Перед передачей проверьте уникальность номера документа в паре с контрагентом: повторная загрузка того же счёта может быть дороже одной ошибки OCR. Отдельно проверьте формат даты: «03.04» в разных системах читается по-разному. Если документ был исправлен после первой загрузки, новая версия должна получить новый идентификатор и отметку, что старое извлечение уже недействительно.

Пилот измеряйте по времени до принятого реестра, числу критичных ошибок и доле полей с подтверждённым источником. Количество извлечённых страниц не показывает качество. Если контроль занимает столько же времени, сколько ручной ввод, возможно, надо сократить список полей или автоматизировать только классификацию документов. Иногда половинчатый процесс честнее, чем красивый полный конвейер с невидимыми исправлениями.

Частые вопросы

Достаточно ли дважды попросить одну модель проверить сумму?

Нет. Повторный ответ может воспроизвести ту же ошибку. Нужна сверка с изображением и независимый расчёт.

Что делать, если таблица уехала после OCR?

Не чините сумму на глаз. Откройте страницу, восстановите соответствие строк и столбцов, затем отметьте причину ошибки в журнале.

Можно ли обойтись без координат блоков?

Да, но для важных полей сохраняйте как минимум номер страницы и фрагмент исходного текста, чтобы проверяющий быстро нашёл место.

Гайды Как проверить калькулятор, созданный нейросетью: пошаговый тест до передачи коллегам Кнопки и графики в ответе ИИ удобны, но не подтверждают формулу. Делаем независимый эталон, проверяем границы и условия безопасного применения. Гайды Как сделать учебные карточки из конспекта с ИИ и не выучить ошибку Пошаговый способ превратить собственные записи в вопросы для самопроверки: от очистки исходника до проверки фактов и повторения трудных карточек. Гайды Как проверить открытую модель в своём стеке: план теста до установки и закупки оборудования Открытые веса дают контроль над запуском, но не отвечают на вопросы о лицензии, качестве и цене обслуживания. Собираем проверку от лицензии до повторяемого тестового набора. Гайды Практика: как проверить поискового агента на инструкции, спрятанные в документах Учебный стенд показывает, сможет ли агент отличить содержимое файла от разрешённой задачи. Никаких рабочих данных и реальных действий не требуется.
Опубликовано: 9 октября 09:14
← На главную