Разработчик С++ базовых технологий генеративного ответа Поиска (Нейро)
офис, гибрид, Москва
Команда развивает бэкенды для генеративного ответа на базе LLM: инференс на GPU, ML-рантайм, взаимодействие с фронтендом и инструменты для прототипирования. Роль важна для качества ответов и стабильности вычислений при длительных запросах.
ГрейдSenior
Стек
C++CUDAREST APIGPUмногопоточностьLLMинференс
Задачи
- •Инференс тяжёлых LLM-моделей на GPU
- •Разработка бэкенда генеративного ответа для поиска
- •Обеспечение взаимодействия с фронтендом (стриминг, API)
- •Организация аллокации компонентов и оптимизация параметров инференса
- •Разработка внутренних сервисов для ML‑прототипирования и приёмочного процесса
Обязательно
- •Знание базовых алгоритмов и структур данных
- •Хорошее знание C++
- •Понимание паттернов и идиом С++
- •Умение писать надёжный и читабельный многопоточный код