Введение: цена ручного ввода
В любой небольшой компании рано или поздно наступает момент, когда сотрудники тонут в бумажной рутине. Бухгалтер перепечатывает реквизиты из счетов, кадровик вносит паспортные данные нового сотрудника, юрист переписывает номера дипломов и трудовых книжек. На это уходят часы, которые можно было бы потратить на анализ, общение с клиентами или развитие бизнеса. Ошибки при ручном наборе приводят к неверным платежам, проблемам с отчётностью и лишним проверкам.
Казалось бы, давно существуют программы распознавания текста. Но классические OCR-решения часто не оправдывают ожиданий: дорогие лицензии, плохая работа с российскими документами, а результат приходится перепроверять и «допиливать» вручную. Именно эту проблему решил закрыть российский разработчик Игорь Морозов, выпустив бесплатное десктопное приложение.

Что умеет «ИИ Сканер документов»
ИИ Сканер документов — это программа для Windows, которая за считанные секунды превращает фотографию, скан или текстовый файл в аккуратно структурированные данные. Вместо «сырого» текста, который ещё нужно разбирать, пользователь получает готовый JSON — формат, который легко импортировать в 1С, CRM, ERP или собственную информационную систему.
Секрет в том, что внутри работает не простой OCR, а современные языковые модели. Они понимают контекст документа, знают, где искать нужные поля, и могут сразу выдать данные в нужном виде.
Какие документы и форматы поддерживаются
Приложение рассчитано на типичные для российских компаний бумаги. Всего их восемь:
- счёт на оплату;
- реквизиты компании;
- анкета;
- паспорт РФ;
- водительское удостоверение;
- диплом;
- патент;
- ЭТК / выписка из ПФР.
На вход можно подать такие форматы, как PDF, JPG, PNG, DOCX, TXT, RTF и HTML. Для изображений и PDF программа использует визуальный анализ страницы, а для текстовых файлов — извлечение содержимого с последующей обработкой языковой моделью. Это значит, что даже старый скан с «кривым» поворотом или плохим освещением имеет все шансы быть распознанным корректно.

Выбор провайдера ИИ
Интересная особенность — пользователь сам решает, какая модель будет обрабатывать документы. Поддерживаются OpenAI (GPT-4o), GigaChat, LM Studio для локального развёртывания и llama.cpp с лёгкими open-source моделями для полностью офлайн-работы. Достаточно вписать свой API-ключ, выбрать модель и указать эндпоинт.
Такой гибкий подход позволяет каждому подобрать баланс между скоростью, качеством и конфиденциальностью. Например, если документы содержат персональные данные, можно запустить локальную модель и вообще не отправлять информацию во внешние сервисы.
Как это работает за три шага
Процесс распознавания максимально прост даже для тех, кто далёк от технологий. Никаких сложных настроек — только три действия:
- Загрузка файла — перетащите документ в окно программы или выберите его через стандартный диалог.
- Выбор типа документа — это нужно, чтобы программа понимала, какие поля извлекать.
- Получение результата — данные отображаются на экране, их можно скопировать или экспортировать в JSON.
Важно, что промпты (инструкции для языковой модели) заранее оптимизированы под российскую специфику. Даты автоматически приводятся к формату ДД.ММ.ГГГГ, номера паспортов очищаются от случайных символов, а телефоны нормализуются к единому виду +7XXXXXXXXXX. Это избавляет от типичных ошибок, которые возникают при ручной обработке.
Автоматизация через REST API
Сам по себе графический интерфейс удобен, но для маленькой компании настоящая ценность появляется тогда, когда можно подключить приложение к своим бизнес-процессам. Для этого предусмотрен локальный REST API на порту 5000.
Через API можно отправлять файлы методом POST и получать JSON с извлечёнными данными. При этом поддерживаются все восемь типов документов и используются те же настройки ИИ, что и в графическом режиме. Примеры запросов и структуры ответов описаны в справочном разделе приложения.
Это открывает широкие возможности: от автоматического создания карточек контрагентов в учетной системе до накопления данных из входящих документов в общей базе. Отделу разработки не придётся писать сложные парсеры — достаточно один раз настроить интеграцию.

Безопасность и локальность
Для многих компаний вопрос конфиденциальности документов критичен. Разработчик подчеркивает: данные не проходят через серверы создателя приложения. Распознавание выполняется напрямую между рабочей станцией и выбранным провайдером ИИ. Таким образом, пользователь контролирует, куда отправляются документы — или же использует полностью локальную модель, если это необходимо.
Сам инструмент распространяется бесплатно. Исходный код закрыт, но компания-разработчик готова выполнять индивидуальные доработки: добавлять новые типы документов, интегрировать с конкретной учётной системой или адаптировать под корпоративные требования информационной безопасности. Это удобно для компаний, которые хотят получить решение «под себя», не разрабатывая его с нуля.
Практические выводы
Для малого бизнеса внедрение такого инструмента — это быстрый способ снять с сотрудников утомительную рутину и снизить количество ошибок. Не нужно покупать дорогие системы документооборота или нанимать разработчиков для создания сложных алгоритмов. Достаточно установить программу, выбрать подходящую модель ИИ и при необходимости настроить обмен данными с существующими сервисами.
Ключевые преимущества, которые стоит взять на заметку:
- Экономия времени: обработка документа занимает секунды, а не часы ручного труда.
- Структурированный результат: JSON сразу готов к интеграции.
- Гибкость провайдеров: от облачных моделей до полностью офлайн-решений.
- Российская специфика: промпты заточены под местные документы и форматы.
Конечно, ни один ИИ не заменит полностью человеческий контроль. Но если нужно освободить команду для более важных задач, «ИИ Сканер документов» — достойный кандидат. Особенно учитывая, что старт бесплатный, а доработки под свои нужды можно заказать отдельно. Технологии уже здесь — осталось просто перестать вводить данные руками.



