Яндекс.Метрика
← Дайджест от 31 июля 2026

МТС протестировала девять OCR-моделей на рукописном русском

Команда МТС опубликовала на Хабре сравнение девяти моделей распознавания текста на рукописном русском. Задача выбора здесь неочевидна: в обзорах советуют старый Tesseract, на Hugging Face лежат PaddleOCR-VL, DeepSeek-OCR, Dots.OCR и Qwen2.5-VL, и каждая называет себя лучшей.

Тестировали не только модели, но и три движка запуска — vLLM, SGLang и обычный Transformers, — потому что от движка зависит скорость и стоимость обработки страницы.