OCR
Optical Character Recognition
Технология распознавания текста на изображениях или отсканированных документах — преобразует пиксельные данные в текстовые для дальнейшей обработки.
Что такое OCR?
OCR (Optical Character Recognition) — технология автоматического распознавания текста с изображений — отсканированных документов, фотографий, PDF-файлов (без машиночитаемого текстового слоя). OCR анализирует пиксели, идентифицирует отдельные символы и собирает из них текст, который затем можно обрабатывать, искать, копировать или передавать в другие системы.
Различают:
- Классический OCR — распознавание символов (Tesseract, ABBYY)
- IDP (Intelligent Document Processing) — OCR + понимание структуры документа с помощью ИИ, распознаёт также структуру (таблицы, заголовки, колонтитулы)
- ICR (Intelligent Character Recognition) — распознавание рукописного текста
Современный OCR на основе глубокого обучения достигает точности 98–99 % на печатном тексте хорошего качества. Проблемы: перекошенные сканы, пятна, нечитаемые печати, таблицы без явных линий — здесь помогает комбинация ИИ/RAG.
В B2B-компаниях OCR наиболее полезен при:
- Входящих счетах в формате PDF — извлечение ИНН, суммы, НДС, срока оплаты
- Договорах — полнотекстовый поиск в архиве
- Авансовых отчётах — чтение чеков
Когда применяется
OCR является входным этапом практически в любой ИИ-автоматизации документов. Без OCR ИИ-модель не смогла бы обработать PDF-счёт или отсканированный договор.
Связанные термины
- Извлечение документов — сквозной процесс OCR + ИИ-извлечение. См. /ru/glossariy/vytazovanie-dokladov-pojem.
- e-Invoice — альтернатива, при которой OCR не требуется. См. /ru/glossariy/e-invoice.
- RAG — после OCR документы, как правило, индексируются в RAG. См. /ru/glossariy/rag.
В Modulario
Модуль Извлечение документов в Modulario сочетает OCR с ИИ-извлечением — PDF-счёт поступает по электронной почте, система применяет OCR, ИИ-модель извлекает все релевантные поля и автоматически создаёт запись входящего счёта в Бухгалтерии.
Modulario использует многоуровневую архитектуру: для машиночитаемых PDF текст извлекается напрямую, для отсканированных документов запускается OCR-движок, обученный на документах с символами кириллицы и латиницы. Точность извлечения типичных полей счёта (ИНН, сумма, дата) в Modulario составляет около 98 %, неоднозначные случаи помечаются для ручной проверки.
Связанные термины
Vyťažovanie dokladov
Автоматизированное считывание счетов, заказов, накладных и других документов с помощью OCR и ИИ — извлечение данных без ручного ввода.
RAG
Техника, расширяющая LLM динамическим поиском по корпоративным документам — ответ формируется на основе найденного контекста и генеративной модели.
AI Agent
Программная система на основе LLM, которая автономно решает задачи — планирует шаги, использует инструменты и вызывает API для достижения цели.
e-Invoice
Структурированный электронный счёт в формате XML/UBL, который можно автоматически обработать без ручного ввода данных.
P2P
Сквозной процесс от создания заявки на закупку через размещение заказа, поставку и получение счёта до оплаты поставщику.
Связанные модули Modulario
Внедряете OCR в своей компании?
Modulario покрывает большинство B2B-процессов модульно — внедряйте только то, что нужно сейчас, и постепенно расширяйтесь. Запишитесь на бесплатную консультацию.
Заказать консультацию