Модель распознавания документов, превращающая сканы и фотографии в размеченный текст. Разворачивается у себя — документы не уходят во внешний сервис.
Что это
Модель, работающая с изображением страницы целиком: возвращает текст с сохранением структуры — заголовки, таблицы, порядок чтения. Особенность подхода в экономном представлении страницы, что снижает объём данных при передаче в языковую модель.
Какую задачу закрывает
Распознавание входящих документов — счетов, актов, договоров — при требовании не выпускать их за периметр. Коммерческие облачные сервисы решают ту же задачу, но предполагают отправку файлов провайдеру.
Кому подходит, а кому нет
- Подходит: Организациям с запретом на передачу документов во внешние сервисы
- Подходит: Пакетной обработке бумажного архива
- Подходит: Командам с доступом к видеокартам
- Не подходит: Тем, у кого нет инженера и оборудования — облачный сервис выйдет дешевле
- Не подходит: Задачам с единичными документами в месяц
Что учесть до внедрения. Код открыт, но обновлений не было с начала 2026 года — это исследовательский релиз, а не поддерживаемый продукт. Веса модели идут под отдельным соглашением, его нужно прочитать до коммерческого применения.
Дальше по теме
Материал оказался полезным?
Спасибо. Это влияет на то, что мы разберём дальше.
