JDOC
PDF → JSON

Как получить структурированный JSON из PDF-документа

Для интеграции мало получить текст из PDF. Системе нужны отдельные поля: тип документа, номер, дата, контрагенты, строки, суммы и другие значения, которые можно разобрать программно.

JDOC возвращает результат распознавания в структурированном виде, поэтому его можно использовать как источник данных для 1С/BAS, ERP, CRM или собственного сервиса.

Что может попасть в JSON

Набор полей зависит от документа. Для счёта это могут быть стороны, банковские реквизиты и строки; для накладной — номенклатура, количество и цены; для выписки — операции и назначение платежа.

  • тип и реквизиты документа;
  • поставщик, покупатель, плательщик или получатель;
  • табличная часть;
  • суммы и НДС;
  • технические данные, необходимые интеграции.

JSON вместо ручного разбора PDF

Интеграции не нужно самостоятельно искать координаты текста на странице или поддерживать десятки шаблонов поставщиков. Она получает уже подготовленную структуру и дальше решает прикладную задачу: найти контрагента, сопоставить номенклатуру или заполнить документ.

Где использовать результат

Структурированный результат подходит для внешних обработок 1С/BAS, ERP и CRM, внутренних очередей документов и собственных сервисов. Перед автоматическим использованием финансовых данных стоит предусмотреть проверку результата и обработку предупреждений.

По теме

Вопросы по теме

Можно ли получить JSON из PDF через API?

Да. JDOC можно использовать через API для передачи файла, получения статуса и структурированного результата.

JSON одинаковый для всех документов?

Структура результата зависит от типа документа и доступных полей, поэтому интеграция должна учитывать конкретный сценарий.

Проверить на своём документе

Загрузите свой PDF, скан или фото и сравните распознанные данные с оригиналом перед использованием в учёте.