Middle CV-инженер (Умные камеры)
офис, Москва
Работа в команде «Умные камеры» над разработкой и внедрением решений компьютерного зрения: обучение детекторов, классификаторов и OCR, интеграция VLM и оптимизация моделей для продакшна. Задача — улучшать точность и скорость инференса для прикладных задач продукта
ГрейдMiddle
Опытот 2 лет
Стек
PythonPyTorchONNX/TensorRTOpenCVYOLODETRCLIPPaddleOCRLoRALLaVAQwen-VLMiniCPM-V
Задачи
- •разработка и дообучение моделей CV: детекторы, классификаторы, OCR
- •интеграция VLM и обучение LoRA-адаптеров под прикладные задачи
- •извлечение визуальных эмбеддингов для поиска, кластеризации и классификации
- •подготовка и разметка датасетов, аугментации и работа с дисбалансом классов
- •эксперименты по архитектурам и гиперпараметрам, оценка качества моделей
- •оптимизация моделей для продакшна и интеграция в инференс-пайплайны
Обязательно
- •коммерческий опыт ML/CV от 2 лет
- •уверенное знание Python и PyTorch
- •практический опыт обучения CV-моделей: детекторы (YOLO, DETR), классификаторы (ResNet, EfficientNet, ViT), OCR (PaddleOCR)
- •понимание базовых концепций deep learning: лоссы, оптимизаторы, регуляризация, метрики (mAP, F1, IoU)
- •опыт работы с OpenCV и/или PIL
- •опыт оптимизации моделей для продакшна: квантизация, экспорт в ONNX/TensorRT
Будет плюсом
- •базовое понимание архитектуры VLM и визуальных эмбеддингов (CLIP, SigLIP)
- •знакомство с готовыми VLM (LLaVA, Qwen-VL, MiniCPM-V) и их применением для VQA, grounding, document understanding
- •навыки работы с генеративными моделями и опыт создания/использования AI-агентов
- •опыт использования GigaChat, Kandinsky и аналогов в продуктах