Распознавание сканов и фотографий документов
Не вся первичка приходит аккуратным PDF. Документы фотографируют телефоном, пересылают в мессенджерах, сканируют пачкой или достают из старого бумажного архива.
JDOC умеет работать со сканами и фотографиями документов: сначала читает изображение, затем пытается определить реквизиты, стороны, таблицы и суммы.
Что влияет на качество распознавания фото
Если исходник плохой, никакая последующая обработка не сможет надёжно восстановить то, чего на изображении не видно.
- весь документ попал в кадр;
- текст не смазан и не закрыт пальцами, печатями или бликами;
- таблица снята без сильного наклона;
- мелкие цифры и итоговые суммы читаются.
Что можно получить из скана
Для счетов, актов и накладных JDOC может подготовить номер, дату, данные контрагентов, строки товаров или услуг, суммы и НДС. Для других типов документов набор полей будет отличаться.
Главное отличие от обычного OCR — результат нужен не как сплошной текст, а как структура для проверки и дальнейшей работы.
Когда этот сценарий особенно полезен
Он подходит для документов из мессенджеров, фото от сотрудников, сканов поставщиков и оцифровки бумажной первички. Перед использованием данных в учёте исходное изображение всё равно нужно сверить с результатом.
По теме
Вопросы по теме
Можно ли распознать документ по фото с телефона?
Да, если фото чёткое, документ полностью попал в кадр и мелкие реквизиты читаются.
Чем распознавание скана отличается от обычного OCR?
OCR возвращает текст. JDOC дополнительно пытается определить структуру документа: поля, стороны, таблицу и суммы.
Проверить на своём документе
Загрузите свой PDF, скан или фото и сравните распознанные данные с оригиналом перед использованием в учёте.