368,530open jobs
9,432companies
50,439added this week
Browse all
Salary
up to $75k per year (net)
Location
In office (Moscow)
Seniority
Staff
Overview
Company
Impact
Profile match
Sber is Russia's largest financial institution and one of the leading technology ecosystems in Eastern Europe. Originally founded as a state savings bank, it has evolved into a comprehensive digital service provider offering banking, e-commerce, cloud computing, and AI-driven solutions. Serving over 100 million retail clients, it plays a central role in the nation's financial system and digital transformation.

Наша команда занимается амбициозной и стратегически важной задачей - построение единого хранилища данных блока B2C - централизованное и эталонное место хранения данных. Мы ищем сильного инженера данных для работы с крупными распределенными системами. Наш стек строится вокруг экосистемы Hadoop, и мы активно развиваем платформу в сторону Data Lakehouse на базе Apache Iceberg и Data Streamhouse на базе Kafka и Apache Flink. Вам предстоит работать с высоконагруженными системами, потоковой обработкой и участвовать в построении единого хранилища данных компании.

Мы предлагаем:

· Интересные задачи по построению Data Lakehouse на базе Apache Spark и Apache Iceberg.

· Работу с большими объемами данных и современным стеком технологий.

· Возможность влиять на архитектурные решения.

Ключевые технологии в вакансии: SQL, Java, Scala, Python, Apache Spark, Apache Iceberg, Apache Hadoop, Greenplum, Gluten, Velox, Oozie, Jenkins, Doker.

Обязанности

Разработка и оптимизация витрин данных:

  • проектирование и реализация эффективных ETL и ELT процессов для витрин данных с использованием Apache Spark и Greenplum. Обеспечение высокой производительности и отказоустойчивости пайплайнов.

Архитектура данных:

  • поддержание и развитие текущих пайплайнов обработки данных на Hadoop с использованием Apache Spark.
  • разработка предложений по развитию Data Lakehouse, внедрение best practices работы с Apache Iceberg (оптимизация партиционирования, compaction, time travel).

Инженерные практики:

  • реализация механизмов инкрементальной загрузки данных для минимизации времени обработки и нагрузки на источники.
  • разработка и документирование API (на Java или Scala) для доступа к данным витрин и сервисам семантического слоя.

Производительность и качество:

  • глубокая оптимизация Spark-приложений, включая использование векторного движка Gluten/Velox для ускорения рабочих нагрузок.
  • разработка решений для сверки и контроля качества данных (Data Quality) с использованием Spark и Python.
  • DevOps и CI/CD: Внедрение разработанных решений в продуктовую среду. Настройка пайплайнов сборки и деплоя в Jenkins, управление зависимостями задач в Oozie или современных оркестраторах.

Коммуникация: Взаимодействие с внутренними бизнес заказчиками для уточнения и согласования требований, презентация доработок сервиса

Требования

  • уверенное владение языками: SQL, Java (или Scala), Python (как вспомогательный для ad-hoc анализа и DQ).
  • глубокое понимание экосистемы Apache Hadoop (HDFS, YARN) и опыт работы с ней в продакшене.
  • опыт разработки пайплайнов на Apache Spark (Core, SQL, Structured Streaming) уровня не ниже middle.
  • понимание форматов хранения данных (Parquet, ORC, Avro) и современных подходов к управлению Data Lakehouse (обязательно знание Apache Iceberg).
  • опыт оптимизации производительности Apache Spark (настройка ресурсов, устранение перекосов данных, работа с memory, оптимизация shuffle).

Будет большим плюсом:

  • опыт внедрения промышленных пайплайнов пакетной передачи данных.
  • опыт внедрения Gluten/Velox или аналогичных векторизованных движков.
  • навыки сборки и развертывания Doker -образов приложений.

Условия

  • офисный формат работы (м Кутузовская)
  • корпоративный спортзал и зоны отдыха
  • более 400 образовательных программ СберУниверситета для профессионального и карьерного развития
  • регулярные митапы и развитое DS-community
  • расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа
  • гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ
  • подписка Прайм с возможностью совместного использования на трёх близких
  • вознаграждение за рекомендацию друзей в команду Сбер.
Free account
Stop reading job ads. Get the ones that fit.
One free account turns this page into a shortlist built around your stack, your level and your pay.
Match on every job. Stack, seniority, pay and location, scored against your profile.
368,530 open roles. Read straight off company career pages, refreshed every day.
Unlimited applications. Every one you send is tracked in one place, on-site or on a company board.
3 tailored CVs a month. Rewritten for the exact job you are applying to. Included free.
Create a free account
Free forever. No card. Under a minute.

Your match

How well do you fit this role?
Two answers are enough for a real match. No account needed.
Check my fit
Answers stay in this browser until you create an account.

Recommended for you based on this role

Similar stack
Same company
Moscow
$16k – $60k per year (Estimated) • In office • Full-Time • PhD • Mumbai
Python
SQL
Python
pySpark
Databases
Presto
Snowflake
AI/ML
Dagster
Prefect
Spark
DevOps
Amazon S3
AWS
CI/CD
Analytics
ETL/ELT
Power BI
Tableau
Apply
$93k – $126k per year • Remote • Full-Time • 5+ years exp • Bachelor's Degree • United States
Node JS
SQL
TypeScript
JavaScript
Databases
MS SQL
Oracle
Mobile
JUnit
DevOps
AWS
Azure
CI/CD
GCP
Git
GitLab
GitLab CI
Jenkins
Management
Jira
QA
JMeter
Playwright
Postman
Rest-Assured
TestNG
Apply
$195k – $264k per year • In office • Full-Time • 15+ years exp • Master's Degree • United States
Python
AI/ML
Amazon SageMaker
Keras
Kubeflow
MLFlow
PyTorch
Scikit-learn
TensorFlow
Vertex AI
XGBoost
DevOps
AWS
Azure
CI/CD
CloudFormation
Docker
GCP
Kubernetes
Terraform
Cybersecurity
FedRAMP
NIST 800-53
Apply
Fullstack QA 5 hours ago
$14k – $32k per year (Estimated) • In office • 3+ years exp • Moscow
JavaScript
Python
SQL
TypeScript
Databases
Apache Kafka
PostgreSQL
DevOps
GitLab
Jenkins
Kubernetes
Management
Bitrix24
Confluence
Jira
Apply
$18k – $46k per year (Estimated) • Remote/Hybrid • Saint Petersburg
C++
DevOps
CI/CD
QEMU
Apply
$36k – $70k per year (Estimated) • In office • Full-Time • 5+ years exp • Moscow
ABAP
DevOps
Bitbucket
Management
Confluence
Jira
Apply
$47k – $106k per year (Estimated) • In office • Full-Time • Moscow
Python
SQL
Python
pySpark
AI/ML
LangChain
LangGraph
LLM
RAG
Spark
Apply
$43k – $108k per year (Estimated) • In office • Full-Time • 3+ years exp • Moscow
C++
Go
Rust
Solidity
SQL
Databases
PostgreSQL
DevOps
CI/CD
Docker
Git
gRPC
Istio
Jenkins
Kubernetes
OpenShift
Web3
Bitcoin
Ethereum
Management
Confluence
Jira
Apply
$36k per year (gross) • In office • Full-Time • 3+ years exp • Moscow
Python
SQL
Python
SQLAlchemy
Databases
MongoDB
PostgreSQL
AI/ML
LLM
Mobile
PWA
DevOps
CI/CD
Docker
Gitflow
Jenkins
kubectl
Git
Kubernetes
Management
Confluence
Jira
QA
Pytest
Apply
$35k – $86k per year (Estimated) • In office • Moscow
Python
SQL
Databases
Apache Kafka
AI/ML
LLM
Model Context Protocol
RAG
DevOps
Grafana
Apply
$21k – $44k per year (Estimated) • Remote • Full-Time • 3+ years exp • Moscow
Python
SQL
Databases
ClickHouse
PostgreSQL
AI/ML
Airflow
DevOps
Amazon S3
Apply
$21k – $35k per year • In office • Moscow
Bash
Python
Databases
MySQL
PostgreSQL
DevOps
Ansible
Debian
Grafana
Proxmox VE
Ubuntu
Zabbix
Apply
$11k – $22k per year (Estimated) • In office • Full-Time • Moscow
Management
Confluence
Jira
Apply
$33k – $81k per year (Estimated) • In office • Full-Time • Moscow
Management
Confluence
Jira
Apply
$41k – $76k per year (Estimated) • In office • Full-Time • Moscow
Python
SQL
Python
pySpark
AI/ML
CatBoost
Hadoop
NLP
NumPy
Spark
DevOps
CI/CD
Apply
See all jobs
This is one of many
368,530 more open roles from verified company boards, updated every day.