699,089open jobs
41,455companies
98,822added this week
Browse all
Salary
$32k – $64k per year (Estimated)
Location
Remote (EAEU, 9am - 6pm)
Seniority
Senior · 6+ years exp
Overview
Company
Impact
Profile match
RUSAL is a leading global aluminum producer headquartered in Moscow, Russia, founded in 2000. The company specializes in the production of primary aluminum, aluminum alloys, foil, and alumina, while also managing bauxite mining and refining operations. It operates a vast network of smelters, refineries, and mines across five continents, supplying metal to the automotive, aerospace, and construction industries worldwide.

Мы в поиске Senior специалиста на позицию ML Platform Engineer (MLOps) в разработку Data Science платформы в РУСАЛ. Требуемый опыт работы: от 6 лет.

ML Platform (MOps) engineer будет заниматься разработкой и эксплуатацией DSML (Data Sciene and Machine Learning) платформы. Наша DSML платформа не просто позволяет создавать и эксплуатировать модели, она позволяет превращать инсайты и экспертизу Data Scientist-а в работающий код, легко передавать ее между Data Scientist-ами и сохранять ее в компании. Платформа работает как on-premise так и в cloud и не имеет здесь аналогов. РУСАЛ DSML платформа разрабатывается на базе решения с открытым кодом SinaraML (github.com/4-DS). SinaraML не только максимально упрощает жизнь Data Scinetist-а, избавляет его от инженерной рутины, но и позволяет ему самостоятельно разворачивать и начинать использовать платформу.

Наша команда - это команда универсалов, где каждый участник включен во все аспекты разработки, экcплуатации и поддержки платформы.

Welcome в нашу команду ML Platform Engineers инженеров:

Если Вы готовы отвечать за эксплуатацию разработанного Вами решения, быть постоянно в рабочее время On Call

Хотите заниматься полным циклом разработки платформ для Machine Learning и Artificial Intelligence начиная с проектирования уровня hardware

Готовы как брать на себя полноту ответственности за всю систему, так и делить ее с командой

Готовы быть адвокатом Data Scientist-ов и обеспечивать поддержку пользователям этих платформ

Если вы в какой-то степени ГИК в своей профессии, постоянно учитесь и Вас не пугает, что нужно планировать бэклог из задач в совершенно новых областях

Если у вас широкое мировоззрение, вы любите Python, Linux, Open Source, Cloud технологии и еще много чего

Вы одинаково любите разработку и эксплуатацию систем и чувствуете себя скорее system engineer-ом, чем software dev-ом или devOps-ом

Если вы способны быстро переключаться между четко выстроенными процессами эксплуатации и гибкими технологиями разработки

Если вам не нравится over-engineering при выборе технологий и разработке, любите делать сложное простым и лаконичным

Если вы умеете балансировать, в зависимости от потребности, между качеством и производительностью Вашей работы, между краткосрочными и долгосрочными целями

Задачи:

  • Разрабатывать и эксплуатировать инфраструктуру вычислительных мощностей ML платформы: вычислительное облако + облако данных. Эксплуатировать VMWare сервера (CPU, GPU, RAM, Disks) платформы, cеть. Экcплуатацией cобственно cерверного/сетевого hardware и VMWare ESXI серверов мы не занимаемся;
  • Разрабатывать и эксплуатировать набор взаимосвязанных K8s кластеров для вычислительного облака ML платформы:

a) K8s кластер вычислительного облака для интерактивной разработки на базе Jupyter Lab;

b) K8s кластер для бэкграунд задач: для запуска ML pipelines по расписанию, для Model Serving;

c) K8s кластер для анализа больших данных на базе Apache Spark.

  • Разрабатывать и эксплуатировать масштабируемое облако данных платформы на базе Apache Ozone, HDFS, S3;
  • Разрабатывать и эксплуатировать инструменты для мониторинга и диагностики работы моделей, на базе Spark, Kafka. Экcплуатацией cобственно Kafka кластеров мы не занимаемся. Участие в разработке и применении типовых DataFlow продуктов для мониторинга моделей (Model Services);
  • Разрабатывать эксплуатировать и поддерживать экземпляры RUSAL DSML платформы на базе SinaraML на языке Python, которая включает следующую функциональность:

a) Инструменты разработки ML pipelines;

b) Инструменты версионирования и прослеживаемости данных;

c) Инструменты управления Data Science экспериментами (воспроизводимость и передаваемость кода);

d) Инструменты масштабирования вычислительных ресурсов для интерактивной разработки и бэкграунд задач;

e) Инструменты Model Serving;

f) Инструменты визуализации, публикации интерактивных отчетов и взаимодействия с бизнесом.

  • Разрабатывать эксплуатировать и поддерживать типовые среды разработки моделей для Сlassic ML, Copmuter Vision, Natural Language Processing;
  • Разрабатывать эксплуатировать и поддерживать инструменты безопасности:

a) Интеграция вычислительного облака и облака данных с Active Directory для аутентификации и авторизации с использованием PAM, Kerberos и др.;

b) Модели доступа данных, сетевые инструменты безопасности

  • Интегрировать компоненты платформы между собой и c корпоративной инфраструктурой включая GitLab, Nexus, Kafka и др.;
  • Обеспечение бесперебойной работы платформы;
  • Создание и поддержка процессов провижнинга пользователей, продуктов, подрядчиков на платформу;
  • Развивать и продвигать в компании сloud-native архитектуру и другие современные инструменты и подходы к разработке;
  • Вести разработку на языке Python. Читать, отлаживать и вносить изменения в код на других языках: Java, C/C++, JavaScript и т.д.
Требования:
  • Опыт администрирования linux, работающих сервисов на базе Open Source;
  • Опыт настройки, отладки, мониторинга и оптимизации производительности систем, начиная с уровня hardware, продолжая уровнем сети, виртуализации, оркестрации и заканчивая конечными сервисами;
  • Опыт разработки современных распределенных software system, основы Web, микро сервисная архитектура и т.д.;
  • Опыт развертывания и эксплуатации разработанных software system;
  • Опыт работы с DevOps инструментами, Git, CI/CD и т.д.;
  • Опыт разработки в команде по SCRUM Kanban методологиям;
  • Умение сочетать гибкие принципы Agile, с дисциплиной для эксплуатации, обеспечение SLA;
  • Опыт разработки на языках: python, bash; опыт отладки кода на java, а также желательно С/С++, JavaScript, scala и др.;
  • Опыт развертывания, эксплуатации и применения K8s инфраструктуры (кластеров);
  • Опыт настройки и экcплуатации сетевых сервисов, nginx или других балансировщиков;
  • Опыт работы со spark и распределенными хранилищами S3/HDFS;
  • Опыт безопасной разработки: аутентификация, авторизация, шифрование и т.д.;
  • Быть сторонником принципов DevOps/SRE, Cloud Native архитектуры;
  • Понимание MLOps практик: ML pipeline, Model Serving, Experiment Management, версионирования данных, моделей, экспериментов, воспроизводимость;
  • Готовность, разрабатывая код, отвечать за его эксплуатацию в продуктовой среде;
  • Готовность, как инженер и разработчик, отстаивать интересы Data Scientist-ов;
  • Уметь следовать и культивировать в компании стандарты вокруг разработки, готовность документировать результаты своего труда.

Плюсом будет:

  • Опыт работы с Cloud платформами типа Amazon, Azure, Google, Yandex;
  • Опыт настройки CI на базе Gitlab;
  • Опыт работы с hadoop;
  • Опыт эксплуатации сервисных шин (MQ, Kafka);
  • Опыт работы с Windows Servers, Active Directory, Kubernetes.
Условия:
  • Возможность присоединиться к команде, работающей над цифровизацией реального сектора экономики;
  • Полностью удаленный режим работы;
  • Возможность участвовать в интересных и сложных проектах с ведущими специалистами индустрии;
  • Пятидневная рабочая неделя (5/2) с 9:00 до 18:00;
  • Работа в крупной международной компании (69 тыс. сотрудников, 1-е место по объему производства алюминия в мире), официальное трудоустройство (белая ЗП, отпуск, больничный);
  • Оформление, оплата отпусков и больничных в соответствии с ТК РФ.

Для связи tg @Tatyana_pim

Free account
Stop reading job ads. Get the ones that fit.
One free account turns this page into a shortlist built around your stack, your level and your pay.
Match on every job. Stack, seniority, pay and location, scored against your profile.
699,089 open roles. Read straight off company career pages, refreshed every day.
Unlimited applications. Every one you send is tracked in one place, on-site or on a company board.
3 tailored CVs a month. Rewritten for the exact job you are applying to. Included free.
Create a free account Continue with Google
Free forever. No card. Under a minute.

Your match

How well do you fit this role?
Two answers are enough for a real match. No account needed.
Check my fit
Answers stay in this browser until you create an account.

Recommended for you based on this role

Similar stack
Same company
Moscow
$40k – $96k per year (Estimated) • In office • 6+ years exp • Bengaluru
Python
Java
C#
C++
C++
TensorFlow C++
PyTorch C++
Databases
Pinecone
AI/ML
LangChain
LlamaIndex
Embeddings
Reinforcement Learning
Computer Vision
NLP
Transfer Learning
TensorFlow
PyTorch
Self-Supervised Learning
Hugging Face
Machine Learning
DevOps
GCP
Azure
AWS
Apply
$38k – $98k per year (Estimated) • In office • 5+ years exp • Bachelor's Degree • Bengaluru
Python
Python
pySpark
Databases
Databricks
AI/ML
Spark
Machine Learning
DevOps
GitHub Actions
Azure
CI/CD
Docker
Kubernetes
Azure AKS
Cybersecurity
SonarQube
Apply
Fullstack AI Engineer 8 hours ago
In office • Bengaluru
Python
JavaScript
Node JS
Python
FastAPI
Databases
Weaviate
ClickHouse
Apache Kafka
AI/ML
LangGraph
LangChain
dbt
Prompt Engineering
Function Calling
Langfuse
LiteLLM
LLM
RAG
Tool Use
Frontend
React.js
DevOps
OpenTelemetry
Apply
$97k – $183k per year (Estimated) • Remote/Hybrid • Full-Time • Sydney
JavaScript
TypeScript
Node JS
AI/ML
Function Calling
Tool Use
Machine Learning
Frontend
React.js
Apply
SDET II 8 hours ago
In office • 3+ years exp • Bengaluru
JavaScript
TypeScript
AI/ML
AI Agents
DevOps
Rest API
GitHub Actions
CI/CD
Jenkins
Git
Docker
Kubernetes
QA
Cucumber
Playwright
Postman
Apply
$15k – $31k per year (Estimated) • In office • Full-Time • 5+ years exp • Bachelor's Degree • Shelehov
Management
Outlook
Microsoft Office
Apply
$13k – $15k per year (net) • In office • Full-Time • Bachelor's Degree • Krasnoyarsk
Apply
$23k – $41k per year (Estimated) • Remote • Full-Time • 3+ years exp • Moscow
SQL
Management
Confluence
Jira
BPMN
Apply
$18k – $37k per year (Estimated) • In office • Full-Time • Moscow
Analytics
Power BI
Superset
Microsoft Excel
Management
Outlook
Directum
Microsoft Office
Apply
$16k – $48k per year (Estimated) • In office • Full-Time • 3+ years exp • Yerevan
Apply
$35k per year (net) • Remote • Full-Time • Moscow
Python
PowerShell
Bash
DevOps
Terraform
Ansible
Zabbix
VMWare
Prometheus
GitLab CI
Azure
CI/CD
AWS
Ubuntu
Grafana
Linux
BGP
OSPF
Cybersecurity
Keycloak
Apply
$28k per year (net) • Remote • Full-Time • Moscow
Apply
$19k – $40k per year (Estimated) • Remote/Hybrid • Full-Time • 2+ years exp • Bachelor's Degree • Moscow
Management
Microsoft Office
Apply
$15k – $25k per year (Estimated) • In office • Full-Time • 1+ year exp • Moscow
Apply
$16k – $33k per year (Estimated) • Remote/Hybrid • Moscow
Apply
See all jobs
This is one of many
699,089 more open roles from verified company boards, updated every day.