RU

Как выбрать OCR в 2026-м: тестируем девять моделей на трех движках инференса на рукописном русском

Вам нужен OCR. В техобзорах рекомендуют Tesseract, на Хабре все пишут про VLM, идете на Hugging Face — там PaddleOCR-VL, DeepSeek-OCR, Dots.OCR, Qwen2…

OCRvlmmws aiраспознавание изображенийраспознавание текстабенчмаркиискусственный интеллектmlинференс ллмдвижки
Habr
RU

Как выбрать OCR в 2026-м: тестируем девять моделей на трех движках инференса на рукописном русском

Вам нужен OCR. В техобзорах рекомендуют Tesseract, на Хабре все пишут про VLM, идете на Hugging Face — там PaddleOCR-VL, DeepSeek-OCR, Dots.OCR, Qwen2…

OCRvlmmws aiраспознавание изображенийраспознавание текстабенчмаркиискусственный интеллектmlинференс ллмдвижки
Habr
RU

Как мы ускорили разметку видеопоиска в десятки раз и не потеряли качество: опыт внедрения VLM-асессора

Современный поиск по видеоконтенту — это высоконагруженная система, требующая молниеносной реакции и безупречной релевантности. Сервис VK Видео оперир…

aivkпоискпоиск видеовидеоконтентvk видеоvlmвидеопоиск
Habr
RU

От 0 до 10 миллионов ИИ-проверок в месяц: как мы продуктивизировали CV в Пятёрочке за 8 месяцев

Статья про то, как CV-сервис вырос с MVP до 10 миллионов проверок фото в месяц и не развалился в проде. 🔧 Это не про «у нас классные модели» и не про …

computer visionmultimodalyoloresnetvlmcnntriton-inference-serverhuman-in-the-loopkafkaритейл
Habr
RU

От 0 до 10 миллионов ИИ-проверок в месяц: как мы продуктивизировали CV в Пятёрочке за 8 месяцев

Статья про то, как CV-сервис вырос с MVP до 10 миллионов проверок фото в месяц и не развалился в проде. 🔧 Это не про «у нас классные модели» и не про …

computer visionmultimodalyoloresnetvlmcnntriton-inference-serverhuman-in-the-loopkafkaритейл