1,385,600open jobs
80,497companies
205,159added this week
Browse all
Salary
up to $70k per year (net)
Location
In office (Moscow)
Seniority
Staff

Confirmed on the employer's own hiring board on Oct 9, 2026. First seen by Alion on Oct 6, 2026. Sber scores A on the Alion truth index.

Overview
Company
Impact
Profile match
Sber is Russia's largest bank and the centre of one of the country's biggest technology ecosystems, tracing its origins to savings institutions established in 1841. It serves over a hundred million retail customers and several million businesses through branch, mobile and web channels, and holds a dominant share of the national deposit, lending and payment markets. Over the past decade the group has built out an ecosystem well beyond banking, spanning e-commerce, food delivery, streaming media, cloud infrastructure, devices and the GigaChat family of large language models developed by its own AI research teams.
Backed by Sber500

Наша команда занимается амбициозной и стратегически важной задачей - построение единого хранилища данных блока B2C - централизованное и эталонное место хранения данных. Мы ищем сильного инженера данных для работы с крупными распределенными системами. Наш стек строится вокруг экосистемы Hadoop, и мы активно развиваем платформу в сторону Data Lakehouse на базе Apache Iceberg и Data Streamhouse на базе Kafka и Apache Flink. Вам предстоит работать с высоконагруженными системами, потоковой обработкой и участвовать в построении единого хранилища данных компании.

Обязанности

  • разработка и оптимизация витрин данных: Проектирование и реализация эффективных ETL и ELT процессов для витрин данных с использованием Apache Spark и Greenplum. Обеспечение высокой производительности и отказоустойчивости пайплайнов.
  • п отоковая обработка данных (RT и NRT): Разработка и поддержка стриминговых пайплайнов. Построение NRT пайплайнов обработки данных из Kafka в Apache Iceberg (Kafka2Iceberg) и RT пайплайнов между Kafka (Kafka2Kafka) с использованием Apache Flink и Spark Structured Streaming.

Архитектура данных:

  • активное участие в разработке архитектуры решения потоковой обработки данных Data Streamhouse данных для обеспечения
  • разработка предложений по развитию Data Lakehouse, внедрение best practices работы с Apache Iceberg (оптимизация партиционирования, compaction, time travel).

Инженерные практики:

  • реализация механизмов инкрементальной загрузки данных для минимизации времени обработки и нагрузки на источники
  • разработка и документирование API (на Java или Scala) для доступа к данным витрин и сервисам семантического слоя

Производительность и качество:

  • глубокая оптимизация Spark-приложений, включая использование векторного движка Gluten/Velox для ускорения рабочих нагрузок
  • разработка решений для сверки и контроля качества данных (Data Quality) с использованием Spark и Python.

DevOps и CI/CD: Внедрение разработанных решений в продуктовую среду. Настройка пайплайнов сборки и деплоя в Jenkins, управление зависимостями задач в Oozie или современных оркестраторах.

Коммуникация: Взаимодействие с внутренними бизнес заказчиками для уточнения и согласования требований, презентация доработок сервиса.

Требования

· Уверенное владение языками: SQL, Java (или Scala), Python (как вспомогательный для ad-hoc анализа и DQ).

· Глубокое понимание экосистемы Apache Hadoop (HDFS, YARN) и опыт работы с ней в продакшене.

· Опыт разработки пайплайнов на Apache Spark (Core, SQL, Structured Streaming) уровня не ниже middle.

· Опыт работы с потоковыми данными: Apache Kafka (как источник/приемник) и хотя бы одним фреймворком стриминговой обработки (Apache Flink или Spark Streaming).

· Понимание форматов хранения данных (Parquet, ORC, Avro) и современных подходов к управлению Data Lakehouse (обязательно знание Apache Iceberg).

· Опыт оптимизации производительности Apache Spark (настройка ресурсов, устранение перекосов данных, работа с memory, оптимизация shuffle).

Будет большим плюсом:

· Опыт внедрения промышленных пайплайнов пакетной передачи данных.

· Опыт внедрения промышленных пайплайнов потоковой передачи данных.

· Опыт внедрения Gluten/Velox или аналогичных векторизованных движков.

· Навыки сборки и развертывания Doker -образов приложений.

Условия

  • офисный формат работы (м Кутузовская ул. Поклонная 3)
  • годовая премия
  • корпоративный спортзал и зоны отдыха
  • более 400 образовательных программ СберУниверситета для профессионального и карьерного развития
  • регулярные митапы и развитое DS-community
  • расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа
  • гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ
  • подписка Прайм с возможностью совместного использования на трёх близких
  • вознаграждение за рекомендацию друзей в команду Сбер.
Free account
Stop reading job ads. Get the ones that fit.
One free account turns this page into a shortlist built around your stack, your level and your pay.
Match on every job. Stack, seniority, pay and location, scored against your profile.
1,385,600 open roles. Read straight off company career pages, refreshed every day.
Unlimited applications. Every one you send is tracked in one place, on-site or on a company board.
3 tailored CVs a month. Rewritten for the exact job you are applying to. Included free.
Create a free account Continue with Google
Free forever. No card. Under a minute.

Your match

How well do you fit this role?
Two answers are enough for a real match. No account needed.
Check my fit
Answers stay in this browser until you create an account.

Recommended for you based on this role

Data Science
Similar stack
Same company
Moscow
Data Ops Engineer 20 days ago
≈ $84k – $161k per year (Estimated) • Hybrid • Full-Time • 4+ years exp • Bachelor's Degree • Charlotte
Python
SQL
Databases
MySQL
Databricks
Cassandra
DynamoDB
InfluxDB
Amazon DocumentDB
AI/ML
Time Series Forecasting
Machine Learning
DevOps
Terraform
Azure
AWS
Amazon Kinesis
Cybersecurity
theHarvester
Analytics
ETL/ELT
Talend
Erwin
Apply
≈ $111k – $240k per year (Estimated) • In office • TS/SCI • Full-Time • Annapolis Junction
Databases
PostgreSQL
Apply
Data Scientist 2 months ago
$89k – $202k per year • In office • Secret • Full-Time • Bachelor's Degree • Arlington
AI/ML
Fine-tuning
Machine Learning
Management
Microsoft Office
Apply
Data Architect 2 months ago
$107k – $220k per year • In office • Secret • Full-Time • Bachelor's Degree • Arlington
Analytics
ETL/ELT
Management
Microsoft Office
Apply
$210k – $250k per year • In office • TS/SCI • Full-Time • United States
Python
JavaScript
SQL
Analytics
ETL/ELT
Management
Agile
Apply
≈ $127k – $264k per year (Estimated) • In office • Annapolis Junction
Python
Java
SQL
C++
Databases
PostgreSQL
DevOps
Git
AWS
Management
Confluence
Jira
Agile
Apply
≈ $160k – $291k per year (Estimated) • In office • TS/SCI • 13+ years exp • Bachelor's Degree • Annapolis Junction
Python
Java
Java
Apache Tomcat
Databases
Oracle
Apache Solr
DevOps
ZooKeeper
VMWare
Windows
Apache HTTP Server
Apply
≈ $129k – $268k per year (Estimated) • In office • Annapolis Junction
Python
Java
Bash
AI/ML
Spark
Airflow
DevOps
Podman
containerd
Git
Docker
Linux
Apply
≈ $109k – $213k per year (Estimated) • In office • 10+ years exp • Linthicum Heights
Python
DevOps
Ansible
Red Hat
VMWare
Kubernetes
CentOS Stream
Linux
Management
Agile
Apply
≈ $114k – $223k per year (Estimated) • In office • TS/SCI • 10+ years exp • Annapolis Junction
Python
JavaScript
Databases
Oracle
DevOps
Terraform
Ansible
VMWare
CentOS Stream
Linux
Apply
≈ $15k – $30k per year (Estimated) • In office • 1+ year exp • Nizhny Novgorod
Python
Python
pySpark
AI/ML
Spark
AI Agents
GigaChat
PyTorch
Machine Learning
Apply
≈ $20k – $39k per year (Estimated) • In office • 1+ year exp • Moscow
Python
Python
FastAPI
pySpark
Databases
Redis
Apache Kafka
AI/ML
Spark
MLFlow
PyTorch
Machine Learning
DevOps
Kubernetes
Amazon S3
Apply
≈ $22k – $54k per year (Estimated) • In office • Moscow
Python
SQL
AI/ML
Hadoop
Spark
Machine Learning
DevOps
CI/CD
Jenkins
Kubernetes
Bitbucket
Management
Confluence
Jira
Apply
Data Engineer 3 days ago
≈ $16k – $31k per year (Estimated) • In office • 2+ years exp • Irkutsk
Java
SQL
Databases
PostgreSQL
Greenplum
AI/ML
Hadoop
DeepSeek
GigaChat
DevOps
CI/CD
Jenkins
Git
Bitbucket
Analytics
ETL/ELT
Apply
≈ $23k – $56k per year (Estimated) • In office • Moscow
Python
SQL
AI/ML
LangChain
CatBoost
XGBoost
Scikit-learn
AI Agents
NLP
NER
Gensim
TensorFlow
NumPy
PyTorch
LLM
RAG
NLTK
Semantic Search
Semantic Search
Machine Learning
Chips/EDA
PoC Library
Analytics
Seaborn
Matplotlib
Apply
Data Quality Engineer 12 hours ago
≈ $19k – $39k per year (Estimated) • Remote (likely EAEU) • 1+ year exp • Moscow
Python
SQL
Databases
Apache Iceberg
Trino
AI/ML
Airflow
Feature Store
DevOps
Git
Grafana
Analytics
Power BI
Apply
$14k – $18k per year • In office • Full-Time • 3+ years exp • Moscow
DevOps
Linux
Windows
Apply
≈ $12k – $21k per year (Estimated) • In office • Moscow
Python
Bash
DevOps
Ansible
GitLab CI
CI/CD
Jenkins
Git
Ubuntu
Nginx
Linux
DNS
Apache HTTP Server
Management
Confluence
Apply
≈ $19k – $51k per year (Estimated) • In office • Moscow
JavaScript
PHP
SQL
1C
PHP
Laravel
Symfony
PHPUnit
Bitrix
Xdebug
Databases
MySQL
PostgreSQL
Redis
RabbitMQ
Apache Kafka
Frontend
Vue.js
Vuex
Vue Router
DevOps
Rest API
Docker Compose
Docker Swarm
GitLab CI
CI/CD
Git
Docker
Kubernetes
Gitflow
SOAP
Management
Confluence
Bitrix24
Agile
Scrum
Kanban
QA
Swagger
Apply
≈ $16k – $38k per year (Estimated) • In office • Moscow
Python
JavaScript
SQL
Bash
Databases
PostgreSQL
SQLite
DevOps
gRPC
Git
Linux
TCP/IP
DNS
Wi-Fi
Cybersecurity
Wireshark
Tcpdump
IoT
MQTT
Apply
See all jobs
This is one of many
1,385,600 more open roles from verified company boards, updated every day.