JDOC
Сканы и фото

Распознавание сканов и фотографий документов

Не вся первичка приходит аккуратным PDF. Документы фотографируют телефоном, пересылают в мессенджерах, сканируют пачкой или достают из старого бумажного архива.

JDOC умеет работать со сканами и фотографиями документов: сначала читает изображение, затем пытается определить реквизиты, стороны, таблицы и суммы.

Что влияет на качество распознавания фото

Если исходник плохой, никакая последующая обработка не сможет надёжно восстановить то, чего на изображении не видно.

  • весь документ попал в кадр;
  • текст не смазан и не закрыт пальцами, печатями или бликами;
  • таблица снята без сильного наклона;
  • мелкие цифры и итоговые суммы читаются.

Что можно получить из скана

Для счетов, актов и накладных JDOC может подготовить номер, дату, данные контрагентов, строки товаров или услуг, суммы и НДС. Для других типов документов набор полей будет отличаться.

Главное отличие от обычного OCR — результат нужен не как сплошной текст, а как структура для проверки и дальнейшей работы.

Когда этот сценарий особенно полезен

Он подходит для документов из мессенджеров, фото от сотрудников, сканов поставщиков и оцифровки бумажной первички. Перед использованием данных в учёте исходное изображение всё равно нужно сверить с результатом.

По теме

Вопросы по теме

Можно ли распознать документ по фото с телефона?

Да, если фото чёткое, документ полностью попал в кадр и мелкие реквизиты читаются.

Чем распознавание скана отличается от обычного OCR?

OCR возвращает текст. JDOC дополнительно пытается определить структуру документа: поля, стороны, таблицу и суммы.

Проверить на своём документе

Загрузите свой PDF, скан или фото и сравните распознанные данные с оригиналом перед использованием в учёте.