787,996open jobs
49,912companies
122,545added this week
Browse all
Salary
≈ $36k – $75k per year (Estimated)
Location
In office (Moscow)
Seniority
Senior

Confirmed on the employer's own hiring board on Sep 24, 2026. First seen by Alion on Sep 25, 2026. Sber scores A on the Alion truth index.

Overview
Company
Impact
Profile match
Sber is Russia's largest bank and the centre of one of the country's biggest technology ecosystems, tracing its origins to savings institutions established in 1841. It serves over a hundred million retail customers and several million businesses through branch, mobile and web channels, and holds a dominant share of the national deposit, lending and payment markets. Over the past decade the group has built out an ecosystem well beyond banking, spanning e-commerce, food delivery, streaming media, cloud infrastructure, devices and the GigaChat family of large language models developed by its own AI research teams.

Мы занимаемся pretrain'ом больших языковых моделей в GigaChat: проектируем архитектуру, подбираем рецепт обучения и поддерживаем весь инженерный контур вокруг него.

Недавно мы обучили MoE-модель на 700 миллиардов параметров - и на этом не собираемся останавливаться. Обучение идёт на кластерах H100 и B200. GigaChat - самый быстрорастущий проект Сбера, и pretrain - его ядро.

Чем занимается команда

  • Архитектура и законы масштабирования.
  • Рецепт обучения: оптимизаторы, расписание learning rate, нормализация, точность вычислений.
  • Устойчивость больших прогонов и ускорение сходимости.
  • Диагностика обучения и оценка изменений с опорой на математический аппарат.
  • Инженерный контур: воспроизводимость, тесты, CI/CD.
  • Роль с акцентом на модель, оптимизацию и инфраструктуру обучения, а не на данные. Главная цель - делать обучение быстрее, надёжнее и предсказуемее.

Какие задачи стоят перед командой

  • Ускорение цикла «идея → эксперимент → вывод → внедрение».
  • Снижение количества ручных прогонов и неочевидных сбоев, повышение воспроизводимости и прозрачности результатов.
  • Повышение надёжности больших прогонов.
  • Ранняя диагностика деградаций и отделение реальных улучшений от ложных сигналов (расхождение, NaN, коллапс энтропии, артефакты маршрутизации, ложное снижение функции потерь).
  • Обеспечение безопасного масштабирования при внедрении крупных архитектурных изменений.
  • Анализ влияния сложных архитектур (например, mixture of experts и маршрутизация) на качество, стабильность и скорость обучения.
  • Определение и развитие метрик, корректно отражающих изменения в обучении моделей.

Почему мы

Масштаб - 700B MoE уже обучена, дальше - больше. Кластеры на H100 и B200.

Публикации. Можно и нужно писать статьи по результатам своей работы - это не ограничивается.

Команда - в России нет другой команды, которая занимается pretrain'ом на таком масштабе. Коллеги - люди, которые глубоко разбираются в теме.

Влияние. Вы берёте направление целиком. Это не «выполнять задачи из бэклога», а самостоятельно определять, что важно, и доводить до результата.

Обязанности

  • Взять на себя целое направление внутри pretrain'а и развивать его: от постановки задач и планирования экспериментов до внедрения результатов в основное обучение.

  • Проектировать и проводить эксперименты: формулировать гипотезы, запускать абляции, сравнивать подходы, разбираться в результатах и превращать выводы в решения для основного обучения.

  • Разбираться с нестабильностью на больших прогонах: искать причины деградаций, строить диагностические метрики, предлагать изменения в оптимизаторе, расписании lr, нормализациях, инициализации, клиппинге, точности вычислений и маршрутизации.

  • Работать с архитектурой смеси экспертов (MoE): маршрутизатор, балансировка нагрузки, переполнение, артефакты маршрутизации, влияние на качество и производительность.

  • Поддерживать большие прогоны и продолжения обучения с чекпоинтов: следить за дрейфом, проверять изменения в коде и конфигурации, снижать риск регрессий.

  • Улучшать инженерное качество контура обучения: ревью критичных изменений, стратегия тестирования, воспроизводимость экспериментов, профилирование и устранение узких мест.

Требования

  • Глубокое понимание устройства обучения нейросетей: не на уровне обзоров и пересказов, а на уровне, где вы можете объяснить, почему конкретный прогон расходится, глядя на кривые функции потерь, нормы градиентов и энтропии.

  • Способность самостоятельно взять направление и довести его до результата: от чтения статей и постановки гипотез до внедрения в основной трейн.

  • Практический опыт с PyTorch и именно с обучением моделей, а не только с инференсом.

  • Умение доводить исследовательские идеи до надёжного инженерного решения: воспроизводимость, конфиги, тесты, автоматизация, понятные критерии качества.

  • Хорошую инженерную культуру: аккуратные PR, профилирование, внимание к качеству кода, понятные отчёты об экспериментах.

Будет плюсом

  • Опыт со смешанной точностью и распределённым обучением.
  • Опыт построения систем оценки моделей или инфраструктуры для экспериментов.

Условия

  • Удалённо.
  • Возможность оформления в аккредитованную IT-компанию.
  • Годовая премия по итогам работы до 6 окладов.
  • Регулярный пересмотр зарплат.
  • Корпоративный спортзал и зоны отдыха.
  • Более 400 программ СберУниверситета для роста.
  • Программа адаптации и помощь руководителя на старте.
  • Крупнейшее DS&AI community - более 600 DS банка, регулярный обмен знаниями, опытом и лучшими практиками, интерактивные лекции и мастер-классы от ведущих ВУЗов и экспертов технологических компаний, дайджест о самых последних разработках в области DS&AI и отчеты с крупнейших конференций мира, регулярные внутренние митапы.
  • Расширенный ДМС, льготное страхование для семьи, корпоративная пенсионная программа.
  • Ипотека для сотрудников по дисконтной программе.
  • СберПрайм+ и скидки у партнёров.
  • Бонус за рекомендации в команду
Free account
Stop reading job ads. Get the ones that fit.
One free account turns this page into a shortlist built around your stack, your level and your pay.
Match on every job. Stack, seniority, pay and location, scored against your profile.
787,996 open roles. Read straight off company career pages, refreshed every day.
Unlimited applications. Every one you send is tracked in one place, on-site or on a company board.
3 tailored CVs a month. Rewritten for the exact job you are applying to. Included free.
Create a free account Continue with Google
Free forever. No card. Under a minute.

Your match

How well do you fit this role?
Two answers are enough for a real match. No account needed.
Check my fit
Answers stay in this browser until you create an account.

Recommended for you based on this role

AI/ML
Similar stack
Same company
Moscow
≈ $41k – $98k per year (Estimated) • Remote (India) • Full-Time • 9+ years exp • Bachelor's Degree • India
Python
JavaScript
Node JS
Python
FastAPI
Databases
Weaviate
Milvus
Pinecone
AI/ML
Copilot
Claude Code
AI Agents
AgentOps
LLM
RAG
Knowledge Graph
Frontend
React.js
DevOps
GCP
Azure
CI/CD
AWS
Management
Jira
Agile
Apply
≈ $63k – $170k per year (Estimated) • In office • South Korea
Python
JavaScript
TypeScript
Node JS
Databases
PostgreSQL
pgvector
Qdrant
AI/ML
Copilot
Claude
Claude Code
Model Context Protocol
AWS Bedrock
Gemini
LLM
RAG
OpenAI
Anthropic
Frontend
Next.js
React.js
DevOps
AWS
GitHub
Apply
Lead - AI Engineer 9 months ago
$26k – $31k per year • In office • Full-Time • 8+ years exp • Chennai
Python
AI/ML
NLP
LLM
RAG
OCR
DevOps
GCP
Azure
CI/CD
AWS
Docker
Apply
Senior - AI Engineer 4 months ago
$10k – $21k per year • In office • Full-Time • 5+ years exp • Bachelor's Degree • Chennai
Python
Rust
C++
Scala
C++
TensorFlow C++
PyTorch C++
Databases
PostgreSQL
Chroma
pgvector
FAISS
OpenSearch
AI/ML
LangChain
LlamaIndex
MLFlow
NLP
NER
spaCy
Transformers
TensorFlow
PyTorch
LLM
RAG
Hugging Face
OCR
DevOps
GCP
CI/CD
AWS
Docker
Cybersecurity
PCI DSS
SOC 2
GDPR
HIPAA
Chips/EDA
PoC Library
Management
ITIL
Apply
$74k – $220k per year • Hybrid • Full-Time • 4+ years exp • Dallas • Tampa • Atlanta • Columbus • Houston
Python
Java
SQL
Databases
Snowflake
AI/ML
Claude
Spark
Vertex AI
AI Agents
LLM
RAG
OpenAI
LLMOps
Context Engineering
LLM Evaluation
Agentic Workflows
DevOps
Terraform
Prometheus
CI/CD
Cortex
Apply
≈ $33k – $70k per year (Estimated) • In office • Moscow
Python
AI/ML
GigaChat
Transformers
PyTorch
LLM
Mixture of Experts
Apply
Data Scientist 12 hours ago
≈ $72k – $157k per year (Estimated) • Hybrid • Full-Time • York • Manchester
Python
SQL
AI/ML
CatBoost
XGBoost
TensorFlow
Pandas
Machine Learning
DevOps
CI/CD
Management
Agile
QA
Pytest
Apply
≈ $84k – $219k per year (Estimated) • Hybrid • Full-Time • York • Manchester
Python
Databases
Databricks
AI/ML
AI Agents
Machine Learning
DevOps
Azure DevOps
Azure
CI/CD
Kubernetes
Apply
In office • Full-Time • Bachelor's Degree • Belgrade
Java
ABAP
DevOps
CI/CD
Git
Apply
≈ $83k – $175k per year (Estimated) • Hybrid • Full-Time • 5+ years exp • Ireland
AI/ML
AI Agents
LLM
LLM Guardrails
DevOps
CI/CD
AWS
Platform Engineering
FinOps
Management
Confluence
Jira
Agile
Apply
≈ $23k – $64k per year (Estimated) • In office • Moscow
Python
AI/ML
DeepSpeed
vLLM
RLHF
SGLang
TRL
GigaChat
Transformers
PyTorch
LLM
DPO
Post-training
Megatron-LM
FSDP
Reward Modeling
Apply
≈ $22k – $61k per year (Estimated) • In office • Moscow
Python
AI/ML
vLLM
CUDA Toolkit
AI Agents
SGLang
TensorRT
TensorRT-LLM
GigaChat
LLM
CUDA
Speculative Decoding
KV Cache
Apply
≈ $22k – $60k per year (Estimated) • In office • Moscow
Python
AI/ML
RLHF
GigaChat
LLM
SFT
Management
Telegram
Apply
≈ $28k – $59k per year (Estimated) • Hybrid • 3+ years exp • Moscow
Python
Java
Python
FastAPI
Django
Asyncio
HTTPX
Litestar
Aiohttp
Java
Testcontainers
Databases
PostgreSQL
Redis
Weaviate
NATS
Milvus
pgvector
Pinecone
Qdrant
RabbitMQ
Apache Kafka
AI/ML
LangGraph
AutoGen
LangChain
LlamaIndex
vLLM
Function Calling
AI Agents
Cohere SDK
Langfuse
LangSmith
Ollama
TGI
Mistral
CrewAI
LLM
RAG
Reranking
OpenAI
Anthropic
Structured Outputs
LLM Guardrails
Multi-Agent Systems
DevOps
Rest API
gRPC
GitHub Actions
OpenTelemetry
Prometheus
GitLab CI
ArgoCD
Docker
Kubernetes
Grafana
Service Mesh
QA
Pytest
Apply
Senior Researcher 2 days ago
≈ $35k – $74k per year (Estimated) • In office • 3+ years exp • Moscow
Python
AI/ML
Hadoop
Spark
RLHF
LLM
DPO
GRPO
FSDP
Apply
$21k – $28k per year • Remote (likely EAEU) • Moscow
PHP
PHP
Bitrix
AI/ML
Cursor
AI Agents
DevOps
SLI/SLO/SLA
Management
n8n
Apply
≈ $26k – $53k per year (Estimated) • In office • 4+ years exp • Moscow
Databases
MySQL
PostgreSQL
ClickHouse
RabbitMQ
DevOps
Ansible
Zabbix
Docker Swarm
etcd
Prometheus
Git
Docker
Nginx
Grafana
Proxmox VE
Linux
DNS
Apply
≈ $13k – $23k per year (Estimated) • In office • 2+ years exp • Moscow
DevOps
Rest API
OpenShift
Jenkins
Git
Grafana
Bitbucket
Management
Confluence
Jira
Apply
≈ $20k – $50k per year (Estimated) • In office • Bachelor's Degree • Moscow
DevOps
Linux
Windows
Cybersecurity
IBM QRadar
SIEM
Apply
≈ $14k – $26k per year (Estimated) • In office • 2+ years exp • Moscow
AI/ML
ElevenLabs
Kling
Runway
Design
DaVinci Resolve
Management
Telegram
Marketing
YouTube
Apply
See all jobs
This is one of many
787,996 more open roles from verified company boards, updated every day.