Как получить структурированный JSON из PDF-документа
Для интеграции мало получить текст из PDF. Системе нужны отдельные поля: тип документа, номер, дата, контрагенты, строки, суммы и другие значения, которые можно разобрать программно.
JDOC возвращает результат распознавания в структурированном виде, поэтому его можно использовать как источник данных для 1С/BAS, ERP, CRM или собственного сервиса.
Что может попасть в JSON
Набор полей зависит от документа. Для счёта это могут быть стороны, банковские реквизиты и строки; для накладной — номенклатура, количество и цены; для выписки — операции и назначение платежа.
- тип и реквизиты документа;
- поставщик, покупатель, плательщик или получатель;
- табличная часть;
- суммы и НДС;
- технические данные, необходимые интеграции.
JSON вместо ручного разбора PDF
Интеграции не нужно самостоятельно искать координаты текста на странице или поддерживать десятки шаблонов поставщиков. Она получает уже подготовленную структуру и дальше решает прикладную задачу: найти контрагента, сопоставить номенклатуру или заполнить документ.
Где использовать результат
Структурированный результат подходит для внешних обработок 1С/BAS, ERP и CRM, внутренних очередей документов и собственных сервисов. Перед автоматическим использованием финансовых данных стоит предусмотреть проверку результата и обработку предупреждений.
По теме
Вопросы по теме
Можно ли получить JSON из PDF через API?
Да. JDOC можно использовать через API для передачи файла, получения статуса и структурированного результата.
JSON одинаковый для всех документов?
Структура результата зависит от типа документа и доступных полей, поэтому интеграция должна учитывать конкретный сценарий.
Проверить на своём документе
Загрузите свой PDF, скан или фото и сравните распознанные данные с оригиналом перед использованием в учёте.