Разрабатываем ПО любой сложности для автоматизации бизнеса

Рассчитать стоимость
Распознавание документов (OCR)

Распознавание и интеллектуальная обработка документов (OCR/IDP)

Встраиваем распознавание документов в ваши процессы: OCR-движок под задачу, пайплайн с валидацией, интеграция с 1С, СЭД и ERP. Пилот на ваших документах — от 105 000 ₽. Свой движок не пишем — честно скажем, если вам хватит готового.

Что такое интеллектуальная обработка документов и когда она окупается

Интеллектуальная обработка документов (IDP) — это когда сканы и файлы превращаются в проверенные данные в ваших системах без ручного ввода: документ приходит с почты, сканера или ЭДО, распознаётся OCR-движком, реквизиты извлекаются и проверяются по справочникам, оператор смотрит только сомнительные поля — и данные ложатся в 1С, СЭД или ERP.

Когда пора автоматизировать обработку документов

Разово распознать пару сканов умеет любой онлайн-сервис — это не наша услуга. Мы нужны, когда документы идут потоком и данные из них должны попадать в учёт без ручного набора.

Типичные сигналы, что пора автоматизировать обработку документов

  • операторы вручную набирают в 1С данные из счетов, накладных и УПД — десятки и сотни документов в день;
  • на вводе ошибки: путаются суммы, ИНН и номенклатура, расхождения всплывают только при сверке;
  • в пиковые периоды очередь из документов растёт быстрее, чем успевают операторы;
  • бумажный архив нужно оцифровать и разложить по атрибутам, а не просто отсканировать;
  • готовый сервис распознавания попробовали, но данные из него некому проверять и некуда класть;
  • документы нельзя отправлять в чужое облако — нужен контур on-premise.
Сигналы, что пора внедрять распознавание документов: операторы вручную набирают первичку в 1С, на вводе ошибки в суммах и ИНН, очередь документов растёт быстрее операторов, бумажный архив нужно оцифровать, документы нельзя отправлять в чужое облако

Цена

Пилот с подбором движка от 105 000 ₽, интеграция от 285 000 ₽

Сроки

Пилот — 1–2 недели, MVP — 2–3 недели, пайплайн — 2–3 месяца

Формат оплаты

Поэтапный · 30% / 40% / 30%

Развилка

Готовая OCR-платформа или внедрение под процесс

Топ поиска занят продуктовыми OCR-платформами — Smart Engines, Dbrain, Beorg, SOICA. Мы с ними не конкурируем: свой движок не пишем, а выбираем под задачу и встраиваем в ваши процессы.

Наша работа начинается там, где заканчивается движок: приём потока, проверка данных и доставка их до учётной системы — то, что не входит ни в одну коробку.

Вопрос
ПродуктГотовая OCR-платформа
ВнедрениеИнтеграция под ваш процесс — мы
Что вы получаете
Движок с кабинетом или API вендора
Пайплайн от приёма документов до данных в 1С, СЭД или ERP
Когда достаточно
Типовые документы, небольшой поток, готовы работать в интерфейсе вендора
Документы потоком, свои правила проверки, данные должны попадать в учёт сами
Кто выбирает движок
Вы — по демо вендора на своих файлах
Прогоняем 2–3 движка на ваших документах на пилоте и показываем замеры
Проверка данных
В рамках настроек продукта
Валидация под ваш учёт: справочники, контрагенты, суммы — плюс верификатор
Данные и контур
Облако вендора; on-premise — отдельной лицензией
Любой вариант, включая полностью изолированный контур

Если задача типовая — например, распознавать паспорта в анкете мобильного приложения через SDK вендора — честно скажем, что хватит готового продукта, и поможем выбрать его на пилоте. Внедрение нужно, когда между «распознали» и «данные в учёте» лежит процесс: классификация, проверки, исключения, интеграции.

Состав работ

Пайплайн обработки: что мы делаем руками

Шесть узлов, из которых складывается путь документа от скана до записи в учётной системе. Движок — только один из них: остальные пять и есть наша работа.

  • Приём потока.
    Почта, сканер, мобильная камера, ЭДО, сетевая папка или API — собираем документы из всех источников в одну очередь обработки.
  • Классификация.
    Определяем тип документа — счёт, УПД, договор, анкета — и отправляем по своему маршруту. Нетиповое уходит в ручной разбор, а не ломает поток.
  • Распознавание движком.
    Подключаем выбранный на пилоте OCR-движок — Smart Engines, Beorg, Dbrain или другой — по API или в вашем контуре. Лицензия движка покупается у вендора.
  • Валидация данных.
    Проверяем извлечённые реквизиты по правилам и справочникам: ИНН — по базе контрагентов, суммы — по арифметике, номенклатуру — по каталогу. Главная защита учёта от «мусора».
  • Верификация оператором.
    Сомнительные поля попадают на рабочее место верификатора: человек видит скан и подсказку движка и правит только то, что требует глаз.
  • Выгрузка в системы.
    Данные ложатся в 1С, СЭД, ERP или вашу самописную систему со ссылкой на исходный скан. Если дальше данные нужно разносить по системам без API — рядом команда внедрения RPA.
Типы документов

Какие документы обрабатываем

Предельные возможности задаёт движок, поэтому по каждому типу говорим честно: что распознаётся уверенно, а что замеряем на пилоте.

Бухгалтерская первичка

Счета, накладные, УПД, акты, счета-фактуры — самый окупаемый поток: реквизиты, табличные позиции и суммы попадают в 1С без набора.

Валидируем по справочникам контрагентов и номенклатуры.

Договоры и неструктурированные документы

Извлекаем стороны, суммы, сроки и условия из договоров, писем и заявлений.

Там, где жёстких полей нет, движок работает в связке с LLM-моделями — это стык с внедрением ИИ.

Паспорта и удостоверения

Паспорта, СНИЛС, водительские удостоверения в анкетных процессах — банки, страхование, HR.

Персональные данные обрабатываем в вашем контуре, с учётом требований 152-ФЗ.

Рукописные анкеты и бланки

Анкеты, опросники, рукописные поля бланков.

Качество на рукописи сильнее всего зависит от самих документов — именно здесь пилот с замером обязателен.

Стоимость

Сколько стоит внедрение распознавания документов

Пилот с подбором движка — от 105 000 ₽, интеграция движка — от 285 000 ₽. Вендоры называют тарифы за документ, но цену проекта внедрения с составом работ не публикует почти никто — мы публикуем.

Интеграция готового движка (MVP)

От 285 000 ₽

Выбранный движок в одном процессе: приём потока, распознавание, базовые проверки, выгрузка в 1С или СЭД

2–3 недели

Пайплайн обработки под ключ

От 615 000 ₽

Классификация типов, валидация по справочникам, рабочее место верификатора, интеграции, журналирование

2–3 месяца

On-premise контур с безопасностью

От 1 175 000 ₽

Пайплайн в вашей инфраструктуре: движок on-premise, разграничение доступа, журналирование, подготовка к требованиям 152-ФЗ

3–4 месяца

На цену влияют: число типов документов, объём потока, количество систем-приёмников и требования к контуру. Оплата поэтапная — 30% / 40% / 30%.

Что оплачивается отдельно. Лицензия OCR-движка и его тарифы за распознавание — у вендора: Smart Engines и Dbrain считают цену по индивидуальному КП, у Beorg есть публичные тарифы от 4 ₽ за документ и on-premise от 114 000 ₽ на полгода. Мы движки не перепродаём и наценку на лицензии не делаем — полную стоимость владения считаем на пилоте, до договора.

Почему дешевле рынка — и почему не в разы. Интеграционный код, конвейер обработки, конфигурации движков и документация пишутся с ИИ примерно вчетверо быстрее — эта экономия уходит в цену. Обследование документооборота, прогоны движков на ваших документах, обучение операторов верификации и приёмка идут по обычной ставке: ИИ их не ускоряет. Поэтому скидка максимальна у интеграции движка, где преобладает код, и заметно меньше у пилота и on-premise-контура.

Граница ответственности

За что отвечаем мы, а за что — вендор движка и качество сканов

В проекте распознавания три силы — движок вендора, качество ваших документов и наша интеграция. Границы зон проговариваем до договора, а не на приёмке.

Вопрос
Чужая зонаВендор движка и смежники
Наша зонаBUDGET SOFT
Лицензия и тарифы движка
Покупаются у вендора: Smart Engines, Beorg, Dbrain и другие
Подбираем движок на пилоте и считаем полную стоимость владения — без наценки
Предельная точность распознавания
Задаётся движком и качеством ваших документов
Замеряем на пилоте по вашим реальным документам и фиксируем измеренный уровень в SLA
Аттестация защищённого контура
Проводит лицензиат ФСТЭК
Готовим систему к требованиям и сопровождаем работы лицензиата
Юридическая значимость документов
Оператор ЭДО и аккредитованный УЦ (электронные подписи)
Встраиваем обмен с ЭДО в пайплайн обработки
Данные в учёте
Полностью наша зона: валидация, верификация, выгрузка в 1С, СЭД и ERP

Про проценты точности скажем прямо: обещать конкретную цифру, не видя ваших документов, нельзя — точность зависит от движка и качества сканов. Поэтому мы её не обещаем, а замеряем на пилоте по вашему реальному потоку и фиксируем измеренный уровень в SLA сопровождения. Если подрядчик называет проценты до того, как увидел ваши документы, он обещает то, что от него не зависит.

Процесс

Как идёт внедрение: от пилота до потока

Каждый этап даёт проверяемый результат; крупные вложения — только после замеров на пилоте.

  1. Пилот на ваших документах — 1–2 недели.
    Берём срез реального потока, прогоняем 2–3 движка, замеряем качество по типам документов. Результат — выбранный движок, честные цифры качества и смета.
  2. Интеграция движка (MVP) — 2–3 недели.
    Встраиваем выбранный движок в один процесс: приём, распознавание, выгрузка в учётную систему. Результат — первые документы проходят без ручного набора.
  3. Пайплайн под ключ — 2–3 месяца.
    Классификация, валидация по справочникам, рабочее место верификатора, обработка исключений, журналирование. Результат — поток идёт сам, люди смотрят только сомнительное.
  4. On-premise и безопасность — 3–4 месяца.
    Переносим контур к вам: движок on-premise, разграничение доступа, журналирование, подготовка к требованиям 152-ФЗ. Результат — документы не покидают периметр.
  5. Сопровождение.
    Следим за качеством на потоке, донастраиваем правила и справочники, подключаем новые типы документов и источники.

Подробнее о том, как устроена работа, — на странице этапов реализации.

Почему мы

Почему обработку документов доверяют BUDGET SOFT

Ниша устроена как продажа своего движка. Мы устроены иначе — работаем на вашей стороне сделки.

Не привязаны к OCR-вендору

Smart Engines, Beorg, Dbrain, SOICA или открытые модели — выбираем по замерам на ваших документах, а не по партнёрской комиссии. Движки не перепродаём.

Скажем, если вам хватит готового продукта

Для типовой задачи с небольшим потоком честный ответ — «купите продукт, внедрение не нужно». Говорим это на пилоте, а не после месяцев разработки.

Точность замеряем, а не обещаем

Проценты в рекламе не рисуем: качество зависит от ваших документов. Замеряем на пилоте, фиксируем измеренное в SLA и поддерживаем на потоке.

230+ проектов за 17 лет

Интеграции с 1С, СЭД и учётными системами — профиль команды. Пайплайн встраиваем в работающий контур; если нужен весь контур согласований и архива — рядом команда систем документооборота.

Отрасли

Обработка документов под ваш поток

Встраиваем распознавание документов в отраслевые потоки — бухгалтерию и финансы, логистику и транспортные документы, банки и страхование, ритейл и дистрибуцию, медицину и кадровые анкеты.

18 направлений

  • ИТ-компании и Digital-агентства
  • Страховые компании и брокеры
  • МФО и ломбарды
  • Интернет-магазины (e-Commerce)
  • Оптовая торговля и дистрибуция
  • Промышленные предприятия
  • Грузоперевозки и экспедирование
  • Медцентры и клиники общего профиля
  • Стоматология
  • Автодилеры и автосервисы
  • Онлайн-образование (EdTech)
  • Юридические и консалтинговые компании
  • Аренда спецтехники и оборудования
  • Агентства недвижимости
  • Застройщики (девелоперы)
  • Турагентства и Event-индустрия
  • Салоны красоты и бьюти-индустрия
  • Ремонтно-строительные компании
FAQ

Частые вопросы о распознавании и обработке документов

Сколько стоит внедрить распознавание документов?

Пилот с подбором движка на ваших документах — от 105 000 ₽, интеграция готового движка в один процесс — от 285 000 ₽, пайплайн обработки под ключ — от 615 000 ₽, on-premise контур с безопасностью — от 1 175 000 ₽. Это цены наших работ; лицензия OCR-движка и его тарифы за распознавание оплачиваются вендору отдельно. Точную смету фиксируем после пилота.

Сколько занимает запуск?

Пилот — 1–2 недели, интеграция движка в один процесс — 2–3 недели, пайплайн под ключ с валидацией и верификацией — 2–3 месяца, on-premise контур — 3–4 месяца. Первые документы проходят без ручного набора уже на этапе интеграции движка.

Может, нам хватит готового сервиса распознавания?

Возможно — и тогда мы так и скажем. Если задача типовая: распознать паспорт в анкете, небольшой поток однотипных документов — достаточно продукта вендора: Smart Engines, Beorg, Dbrain. Внедрение нужно, когда между распознаванием и учётом лежит процесс: классификация, проверки по справочникам, исключения, интеграция с 1С или СЭД. На пилоте разбираем задачу и честно называем более дешёвый вариант, если он есть.

Какую точность распознавания вы гарантируете?

Заранее — никакую, и не верьте тем, кто обещает проценты, не видя ваших документов. Точность определяется движком и качеством сканов: печатная первичка распознаётся уверенно, мятые рукописные бланки — заметно хуже. На пилоте замеряем точность на вашем реальном потоке по типам документов, а в проекте фиксируем измеренный уровень в SLA. Ошибки ловят валидация по справочникам и верификатор.

Что входит в цену, а что оплачивается отдельно?

В цену входят наши работы: пилот и замеры, интеграция движка, пайплайн, валидация, рабочее место верификатора, интеграции с вашими системами. Отдельно у вендора оплачивается лицензия OCR-движка и его тарифы за распознавание — например, у Beorg есть публичные тарифы от 4 ₽ за документ. Мы наценку на лицензии не делаем, полную стоимость владения считаем на пилоте.

Можно ли развернуть распознавание в нашем контуре, без чужого облака?

Да, это пакет «On-premise контур»: движок в вашей инфраструктуре, документы не покидают периметр, доступы разграничены, действия журналируются — так работают с персональными данными по 152-ФЗ и с чувствительной первичкой. Если контур требуется аттестовать, аттестацию проводит лицензиат ФСТЭК — мы готовим систему и сопровождаем его работы.

Распознаёте рукописный текст?

Современные движки читают рукописные поля анкет и бланков, но именно на рукописи разброс качества самый большой: почерк, сканер, состояние бланка. Обещать проценты не будем — включим рукописные документы в пилот и покажем замеры. Часто рациональная схема — автоматика на печатном тексте плюс верификатор на рукописных полях.

Чем это отличается от RPA и компьютерного зрения?

Распознавание документов превращает сканы в проверенные данные в учёте. RPA переносит данные между системами, когда у них нет API, — эти работы часто идут вместе, и обе делаем мы. Компьютерное зрение — про изображения и видео с камер: брак на конвейере, подсчёт объектов, номера машин. Если задача про поток документов и данные в учёте — вы на нужной странице.

4×
дешевле разработка
от 2 недель
от идеи до MVP
60+
реализованных проектов
17 лет
опыта в IT
Портфолио

Кейсы, которыми гордимся

Расскажите, какие документы и в каком объёме к вам приходят, — предложим движок под задачу и назовём цену и срок пилота на ваших файлах.

Обычно отвечаем в течение рабочего дня.