Свежая вакансия
Появилась 9 дн назад
Обязанности
- Поддержка GPU/TPU кластеров, контейнеризация и оркестрация с использованием Docker и Kubernetes.
- Аудит и оптимизация инфраструктуры и затрат, разграничение проблем железа и кода.
- Настройка мониторинга, алертинга и управление железом между пользователями.
- Развертывание и поддержка ML-сервисов (MLflow, Airflow, CVAT, Doccano) в production.
- Настройка CI/CD для ML-пайплайнов и управление полным ML lifecycle (training -> serving).
Требования
- Опыт DevOps от 4 лет, MLOps от 1 года.
- Опыт работы с GPU/TPU инфраструктурой (NVIDIA stack, CUDA).
- Коммерческий опыт с Docker, Ansible, Kubernetes, понимание baremetal.
- Знание ELK, Prometheus, Grafana.
- Опыт с ML Serving (Triton, vLLM или аналоги).
- Знание Postgres, Redis, Kafka.
Показать как в источнике
Senior MLOps Engineer (B2C команда)
#удаленка #офис #senior
Компания: Островок!
🔹Ключевые задачи:
- Поддержка кластеров (GPU/TPU), контейнеризации и оркестрации (Docker, Kubernetes);
-Аудит, оптимизация инфраструктуры и затрат (batch vs real-time inference, разграничение проблем железа и кода);
-Настройка мониторинга, алертинга и менеджмент железа между потребителями;
-Развертывание и поддержка ML-сервисов (MLflow, Airflow, CVAT, Doccano) в production;
-Настройка CI/CD для ML-пайплайнов и управление полным ML lifecycle (training -> serving).
🔹Требования:
-Опыт DevOps от 4х лет, MLOps от 1 года;
-Опыт с GPU/TPU инфраструктурой (NVIDIA stack, CUDA);
-Коммерческий опыт с Docker, Ansible, Kubernetes; понимание специфики baremetal;
ELK, Prometheus, Grafana;
-Опыт с ML Serving (Triton/vLLM/аналоги);
Postgres, Redis, Kafka.
Откликнуться
IT Jobs в Telegram | в VK | в Max