Интеллектуальная классификация и локальный OCR для документов

Смотреть урок

Дополнительные файлы из урока

В этом уроке я показываю обновление своего сервиса DocProcessingService: теперь он умеет делать OCR локально, на том же сервере, где работает n8n, — на базе Tesseract с поддержкой русского и английского. Разбираю, как обновить стек в Portainer (остановить, удалить старые образы и volumes, подтянуть новый образ) и как работает endpoint /convert?ocr=true: распознавание срабатывает только на страницах с изображениями, остальной текст извлекается из PDF как есть.

Дальше собираю…

🔒

Этот материал доступен участникам Клуба. Войдите или оформите доступ, чтобы читать целиком, открывать видео и комментировать.

Войти Вступить / купить доступ