Старший Go разработчик, ML платформа
удалёнка, гибрид, Москва
Команда платформы инференса строит отказоустойчивую high‑throughput инфраструктуру для запуска ML-моделей в продуктах Ozon. Вы будете развивать сервисы и оптимизации для исполнения моделей на GPU, влияющие на latency и пропускную способность платформы
ГрейдSenior
Опытот 4 лет
Стек
GoTriton Inference ServerPostgreSQLKubernetesJavaPythonDockerNVIDIA Device PluginTensorRTONNX RuntimeRedisS3KafkaGitLab CI
Задачи
- •Проектирование и разработка высоконагруженных сервисов инференса
- •Оптимизация выполнения моделей на GPU: batching, управление памятью, MIG
- •Интеграция ML-рантаймов (TensorRT, ONNX Runtime, Triton) в платформу
- •Реализация автоскейлинга и распределения нагрузки в Kubernetes
- •Обеспечение SLA: расследование инцидентов и устранение узких мест
Обязательно
- •Коммерческий опыт разработки на Go или Java/Kotlin от 4 лет
- •Проектирование микросервисной архитектуры и опыт с распределёнными системами
- •Понимание многопоточности и конкурентного программирования
- •Умение писать чистый, тестируемый и поддерживаемый код
- •Опыт работы с облачной инфраструктурой (желательно Kubernetes)
Будет плюсом
- •Опыт с ML‑инфраструктурой и GPU (CUDA, Triton, KServe)
- •Понимание MLOps‑практик
- •Опыт работы с Kafka или другими системами очередей
- •Опыт оптимизации высоконагруженных систем