Salary
≈ $18k – $45k per year (Estimated)
Location
Remote (EAEU)
Employment
Full-Time
Overview
Company
Impact
Profile match
Cloud.ru is a major Russian provider of cloud services and artificial intelligence solutions, formerly operating under the name SberCloud. The company offers full-stack infrastructure and platform tools (IaaS, PaaS, and machine learning environments) to support enterprises, startups, and developers across various industries. Operating through robust Tier III data centers, it delivers high-performance compute resources, managed cloud products, and enterprise-grade security compliance.
На этой позиции тебе предстоит:
- Участие в продуктовой RUN команде
- Методология наблюдаемости - формировать требования к данным и метрикам; внедрять стандарты надёжности данных и лучшие практики наблюдаемости
- Анализ потоков и метрик - работать с Prometheus, Loki, OpenTelemetry и др.; выявлять отклонения, узкие места и возможности оптимизации
- Data QA (контроль качества данных) - проверять полноту, корректность и соответствие требованиям; автоматизировать проверки через Quality Gates (правильность схемы, покрытие метрик, отсутствие дублирования, соответствие SLA/SLO) → оценка качества перед попаданием в прод
- Тестирование и R&D Ops - писать и поддерживать автоматические тесты компонентов мониторинга; проверять наличие и корректность метрик, логов, трассировок после деплоя; планировать тесты надёжности (отказы узлов, сетевые задержки, падения зависимостей) и канарейковые/теневые развертывания с автоматическим откатом; проводить нагрузочное тестирование, сравнивать результаты с базовым профилем; исследовать новые технологии, собирать метрики,готовить рекомендации; интегрировать Quality Gates в CI/CD - каждый релиз проходит проверку качества и надёжности; отслеживать эффективность через SRE-KPIs (MTTR, доля неудачных изменений, коэффициент успешных хаос-тестов, переход PoC → прод) и публиковать их в дашбордах
- Разбор инцидентов и RCA - анализировать логи, трассировки, метрики, ETL-pipeline; документировать причины, фиксировать ошибки, предлагать решения; вести базу знаний (post-mortem, операционные руководства)
- Техническая документация - создавать и актуализировать схемы потоков данных, инструкции, описания архитектуры платформы
- Развитие внутренней платформы мониторинга - улучшать функциональность и производительность; автоматизировать наблюдаемость и оповещения как код ); интегрировать пороги проверки качества в CI/CD для проверки перед деплоем
- Обучение и передача знаний - готовить обучающие материалы, проводить воркшопы. Способствовать принятию единых практик наблюдаемости
Что мы ждем от кандидата:
- Знаете, как сделать отказоустойчивый масштабируемый сервис
- Имеете опыт написания и ревью технической документации Имеете опыт коммуникации с разработчиками и бизнесом (объяснение компромиссов между надёжностью и разработкой функций)
- Обладаете системным мышлением и умением анализировать сложные сценарии отказа, выявлять корневые причины, находить способы их устранения
- Имеете практический опыт построения и внедрения quality gates в CI/CD процесс для управления рисками при развертывании: для предотвращения попадания нестабильных изменений в прод
- Знаете, как определять SLISLO для сервиса, у которого нет исторических данных о надежности
- Знаете, как рассчитать композитные SLO для сервиса, зависящего от 10+ микросервисов
- Имеете опыт внедрения наблюдаемости как код (observability as code), оповещения как код (alerting as code))
Free account
Stop reading job ads. Get the ones that fit.
One free account turns this page into a shortlist built around your stack, your level and your pay.
Match on every job. Stack, seniority, pay and location, scored against your profile.
368,746 open roles. Read straight off company career pages, refreshed every day.
Unlimited applications. Every one you send is tracked in one place, on-site or on a company board.
3 tailored CVs a month. Rewritten for the exact job you are applying to. Included free.
Free forever. No card. Under a minute.
Your match
How well do you fit this role?
Two answers are enough for a real match. No account needed.
Check my fit
Answers stay in this browser until you create an account.
Recommended for you based on this role
Similar stack
Same company
Moscow
Founding Engineer
1 day ago
$81k – $116k per year • In office • Full-Time • Bachelor's Degree • Munich
JavaScript
Python
TypeScript
Databases
MySQL
PostgreSQL
Frontend
Next.js
React.js
Tailwind CSS
DevOps
AWS
Azure
CI/CD
Docker
GCP
Grafana
Kubernetes
OpenTelemetry
Prometheus
Apply
Principal Platform Engineer
1 day ago
≈ $84k – $178k per year (Estimated) • In office • Full-Time • 10+ years exp • Wellington
Java
Python
DevOps
Ansible
AWS
Azure
CI/CD
Docker
GCP
Helm
Kubernetes
Platform Engineering
Prometheus
Service Mesh
Terraform
GitLab
IAM
Apply
≈ $98k – $195k per year (Estimated) • In office • Full-Time • 7+ years exp • Wellington
Java
Python
SQL
Java
Spring Boot
Databases
Apache Kafka
Databricks
Neo4j
AI/ML
Flink
Spark
Frontend
GraphQL
DevOps
Azure
CI/CD
Datadog
Dynatrace
Kibana
Kubernetes
OpenShift
Platform Engineering
Splunk
Amazon ECS
Apply
≈ $123k – $251k per year (Estimated) • In office • Full-Time • 5+ years exp • Bachelor's Degree • Dallas • Denver • Birmingham
Java
SQL
Java
Gradle
Hibernate
Maven
Spring Boot
Spring Framework
Databases
Apache Kafka
MySQL
Redis
DevOps
CI/CD
Dynatrace
Jenkins
Kubernetes
OpenShift
Cybersecurity
SonarQube
Apply
≈ $28k – $58k per year (Estimated) • Remote/Hybrid • Full-Time • 7+ years exp • Moscow
DevOps
Ansible
CI/CD
FinOps
Kubernetes
OpenStack
SLI/SLO/SLA
Terraform
VMWare
Apply
LlmOps-DevOps
5 days ago
≈ $18k – $46k per year (Estimated) • Remote/Hybrid • Full-Time • Moscow
Python
AI/ML
CUDA
CUDA Toolkit
KServe
LLM
ONNX
PyTorch
Ray
Ray Serve
TensorRT
TensorRT-LLM
Transformers
Triton
Triton Inference Server
vLLM
Hugging Face
LLMOps
Mixture of Experts
NCCL
Seldon Core
TGI
DevOps
CI/CD
Docker
Git
Kubernetes
Apply
Инженер технической поддержки (L2)
6 days ago
≈ $12k – $22k per year (Estimated) • Remote • Full-Time • Moscow
Databases
Apache Kafka
MySQL
PostgreSQL
Redis
DevOps
Kubernetes
Nginx
OpenStack
Proxmox VE
VMWare
Apply
DevOps (Кибербезопасность)
7 days ago
≈ $17k – $44k per year (Estimated) • Remote • Moscow
DevOps
Ansible
ArgoCD
CI/CD
Git
GitOps
Kubernetes
Terraform
Cybersecurity
Least Privilege
Apply
Менеджер продукта Evo CNI
7 days ago
≈ $23k – $49k per year (Estimated) • Remote/Hybrid • 3+ years exp • Moscow
DevOps
AWS
Azure
GCP
Kubernetes
Yandex Cloud
Apply
Менеджер продукта
7 days ago
≈ $18k – $49k per year (Estimated) • Remote/Hybrid • Moscow
AI/ML
Embeddings
Fine-tuning
LLM
RAG
Apply
≈ $18k – $45k per year (Estimated) • Remote/Hybrid • Moscow
AI/ML
CUDA
CUDA Toolkit
cuDNN
LLM
NVLink
Ollama
PyTorch
TensorRT
vLLM
DevOps
Docker
Windows Server
Apply
Программист 1С ERP (WMS, ЕГАИС)
4 hours ago
≈ $16k – $37k per year (Estimated) • Remote/Hybrid • Full-Time • Moscow
Databases
Apache Kafka
PostgreSQL
Management
Bitrix24
Jira
Apply
≈ $22k – $41k per year (Estimated) • Remote • 3+ years exp • Moscow
Python
SQL
AI/ML
LLM
OpenAI
Analytics
Power BI
Tableau
Apply
Bi-аналитик (Data Platform)
6 hours ago
≈ $21k – $44k per year (Estimated) • Remote • Full-Time • Moscow
Python
SQL
Databases
ClickHouse
PostgreSQL
AI/ML
Airflow
DevOps
Amazon S3
Apply
Системный администратор Linux / DevOps инженер
6 hours ago
$21k – $35k per year • In office • Moscow
Bash
Python
Databases
MySQL
PostgreSQL
DevOps
Ansible
Debian
Grafana
Proxmox VE
Ubuntu
Zabbix
Apply
This is one of many
368,746 more open roles from verified company boards, updated every day.

