СберСбер

Senior DevOps LLM (Инвестиционный бизнес)

гибрид, Москва

Команда развивает инвестиционную платформу для сопровождения сделок; вы будете строить и поддерживать LLM‑инференс, инфраструктуру агентов и observability для высоконагруженных микросервисов, чтобы обеспечить надёжность и требуемую производительность сервисов

ГрейдSenior

Стек

PythonFastAPIPostgreSQLKubernetesDockerIstioKafkavLLMTGITensorRT-LLMGrafanaPrometheusJaegerOpenTelemetryJenkinsGitLab CIHelmLokiClickHouseGit

Задачи

  • Развёртывать и конфигурировать Open Source LLM на собственных мощностях
  • Настраивать и оптимизировать инференс‑сервера (vLLM, TGI, TensorRT-LLM, llama.cpp) и GPU (батчинг, quantization, управление VRAM)
  • Реализовывать health checks, алерты и мониторинг производительности через Grafana/Prometheus/OpenTelemetry
  • Настраивать сквозную трассировку (trace_id) и корреляцию логов/трейсов для быстрого расследования инцидентов
  • Интегрировать Prompt Hub, создавать системные промпты и описания агентов, интегрировать агентов с внешними API и базами данных
  • Автоматизировать CI/CD пайплайны, E2E‑тесты и доставку обновлений инфраструктуры и сервисов

Обязательно

  • опыт развёртывания и сопровождения Open Source LLM в продакшене
  • практическое знание инструментов инференса: vLLM, TGI или аналогичных (TensorRT-LLM и пр.)
  • понимание внутренних механизмов инференса: KV-cache, continuous batching, quantization (GGUF, GPTQ, AWQ)
  • уверенное владение Python для сервисов и интеграций
  • экспертный опыт с контейнеризацией Docker
  • опыт управления кластерами Kubernetes и Helm
  • опыт построения observability‑стека: Grafana, Prometheus, Jaeger, OpenTelemetry

Будет плюсом

  • опыт с фреймворками агентов: LangChain, LlamaIndex, AutoGen или собственные решения
  • знание подходов fine‑tuning и evaluation LLM: LoRA/QLoRA, Axolotl, Unsloth, DeepEval, LM Evaluation Harness
  • опыт управления GPU‑инфраструктурой (NVIDIA A100/H100, L40S, MIG, vGPU)
  • администрирование Linux и работа с драйверами NVIDIA
  • опыт работы с LangChain/LlamaIndex/AutoGen в продакшне
Откликнуться на сайте компании

Похожие вакансии

МТСМТС

Senior Devops Engineer [Прогрессоры]

KubernetesHelmPostgreSQLPrometheus

Инфраструктура и CI/CD платформы для сервиса Прогрессоры

Опыт: от 5 лет
удалёнка, гибрид, Москва
ЯндексЯндекс

SRE-инженер в общую облачную платформу Финтеха

PythonKubernetesSQLTerraform

Облачная платформа для стабильной работы финтех-среды

удалёнка, гибрид, Санкт-Петербург
АльфаАльфа

DevOps/ Middle+

PythonKubernetesElasticsearch / ELKKafka

Инфраструктура и CI/CD для систем контроля доступа и антифрода

Опыт: от 3 лет
офис, удалёнка, гибрид, Москва
СберСбер

SRE инженер (AEF)

PythonKubernetesJenkinsArgo CD

Платформа для разработки и исполнения GenAI-агентов

Опыт: от 5 лет
гибрид, Москва
МТСМТС

Ведущий инженер технической поддержки (Цифровой бизнес)

SQLKibanaGrafanaJira

Поддержка и мониторинг цифровых сервисов банка

Опыт: 1–3 года
удалёнка, гибрид, Москва
ДОМ.РФДОМ.РФ

DevOps-инженер (Платформы данных и аналитические системы)/ИТ

GoKubernetesDockerKafka

Инфраструктура data‑платформы и пайплайнов обработки

Опыт: от 5 лет
удалёнка, гибрид, Москва

Смотреть ещё

JobsWave
Найти работу в IT