ML engineer on X5 Tech's recommendation-systems team: develops online search/recommendation models, writes production code, and keeps ML inference stable in production. Day-to-day work centers on Triton Inference Server, Kubernetes, CI/CD, and the PyTorch/Docker/Airflow stack.
Ищем инженера, который будет отвечать за стабильную работу ML-инфраструктуры и сервисов инференса в production.
В этой роли предстоит настраивать и поддерживать Triton Inference Server, работать с Kubernetes и CI/CD, следить за стабильностью ML-сервисов и пайплайнов, разбирать инциденты и постепенно улучшать инфраструктуру.
Чем предстоит заниматься
Разрабатывать онлайн-модели поиска и рекомендаций.
Писать поддерживаемый продакшн-код и проводить код-ревью.
Обеспечивать стабильный инференс в продакшене.
Что ожидаем
Уверенное знание PyTorch.
Опыт работы над рекомендательными системами или поиском.
Знание классических и передовых ML-алгоритмов.
Знакомство с Docker и Airflow.
Способность довести задачу от идеи до A/B-теста.
Будет плюсом
Опыт в MLOps: CI/CD, версионирование моделей, автоматизация обучения и деплоя.
Опыт эксплуатации ML-сервисов в продакшене: мониторинг, диагностика проблем.