Компания "Haulmont"
Задачи:
- развитие и поддержка MLOps-инфраструктуры для обучения, деплоя и мониторинга
ML-моделей;
- управление крупным GPU-сервисом: планирование ресурсов, утилизация,
autoscaling, отказоустойчивость;
- автоматизация ML/CI/CD-пайплайнов и production-ready deployment;
- контейнеризация и оркестрация ML-сервисов (Docker, Kubernetes);
- мониторинг производительности, стоимости и стабильности GPU-инфраструктуры;
- взаимодействие с ML/DS-командами для быстрого и надежного вывода моделей в продакшн.
Требования:
- 3+ лет опыта в MLOps / ML Platform / DevOps for ML;
- практический опыт управления большой GPU-инфраструктурой или GPU-кластерами;
- уверенные знания Docker, Kubernetes, Linux, Python;
- опыт с ML-пайплайнами, batch/online inference, CI/CD;
- понимание мониторинга, логирования и observability (Prometheus, Grafana, ELK и др.);
- опыт оптимизации использования GPU-ресурсов, очередей и стоимости вычислений
- опыт с MLflow, Airflow, Ray, Slurm, Kubeflow.
20 Июля
Санкт-Петербург
Компания "Доктор Веб" «Доктор Веб» создает антивирусные программы для разных операционных систем и мобильных платформ, для домашнего...
18 Июля
Санкт-Петербург
Компания "Aston" Aston — аккредитованная аутсорсинговая IT-компания, работающая с 2007 года. Наш штат насчитывает 2500+ специалистов. Мы...
21 Июля
Senior QA automation Python specialist
Санкт-Петербург
Компания "ТАКСТЕЛЕКОМ" Привет! Мы - аккредитованная IT компания Maxim Technology. Занимаемся разработкой платформы для пассажирских и грузовых...
05 Июля
Системный администратор-универсал (DevOps / Network / Installation Specialist)
Санкт-Петербург
от 100 000 руб.
Компания "Адабир Елена Владимировна" Компания-работодатель является поставщиком изделий медицинского назначения в государственные организации....
18 Июля
Специалист по инфраструктуре машинного обучения (MLOps-инженер)
Санкт-Петербург
Компания "ГАЗИНФОРМСЕРВИС" Наша Лаборатория технологий искусственного интеллекта находится на этапе трансформации: мы переходим от успешных...
Вакансия размещена в отрасли