716,098open jobs
42,633companies
101,517added this week
Browse all
Salary
$53k – $125k per year (Estimated)
Location
Remote (EAEU)
Seniority
Staff

Confirmed on the employer's own hiring board on Sep 22, 2026. First seen by Alion on Sep 23, 2026. Wildberries scores A on the Alion truth index.

Overview
Company
Impact
Profile match
Wildberries is Russia's largest e-commerce platform and online retailer, offering a vast array of consumer goods ranging from apparel and electronics to home essentials. The company focuses on facilitating digital trade for millions of third-party merchants while managing an extensive logistics network of fulfillment centers and local pickup points. Headquartered in Moscow, Russia, it expands commercial access and fast delivery services across multiple international markets.

Направление работы:

Мы - направление модерации в отделе Trust & Safety, отвечаем за безопасность и модерацию контента и карточек товаров на WB. Ежедневно через наши системы проходят десятки миллионов карточек товаров, мы обрабатываем сотни миллионов решений по более чем 100 ML-моделям. Модели инферятся через Nvidia Triton Inference Server и vLLM на десятках инстансов в нескольких дата-центрах, GPU-парк гетерогенный, с MIG и HAMi, пиковая нагрузка порядка 400-500K RPS.

Мы строим единую ML-платформу для всех DS-направлений Trust & Safety, где уже 20+ DS в модерации и 50+ во всём отделе. Платформа растёт, и вместе с ней растёт команда. Рядом соседняя команда Moderation Engine из 5 backend-инженеров, которая владеет логикой модерации и является главным потребителем платформы.

Стань частью команды!

Вам предстоит:

  • Отвечать за инференс под нагрузкой (~200K запросов/сек в среднем, до 400-500K в пике), включая дежурства в ротации, инцидент-менеджмент, постмортемы и безопасные обновления;

  • Проектировать единый inference gateway и hot reload моделей как основу self-service деплоя;

  • Вести capacity planning и миграцию моделей между поколениями GPU;

  • Стандартизировать путь модели от эксперимента до прода вместе с DS, в том числе ClearML pipelines, model registry, конвертацию в ONNX и TensorRT, профилирование инференса;

  • Выстроить взаимодействие через API-контракты и SLA между командами;

  • Подключать DS-направления за пределами модерации и вести прозрачный intake их запросов;

  • Вести команду, включая найм на две открытые позиции, онбординг, рост инженеров и распределение ответственности.

Формат работы - гибридный или удаленный по договоренности с руководителем.

Вы нам подходите, если:

  • Ваш опыт руководства командой инженеров от 5 человек, включая 1:1, планы развития, распределение ответственности и найм;

  • Имеете опыт эксплуатации ML-инференса в проде на Triton Inference Server, vLLM или аналогах, в том числе деплой и обновление моделей без потери качества;

  • Имеете сильный инженерный бэкграунд в Go/Python, асинхронных сервисах, gRPC и Kubernetes, в том числе с GPU-ресурсами;

  • Имеете опыт эксплуатации высоконагруженных систем с SLA/SLO, мониторингом, инцидент-менеджментом и безопасными релизами;

  • Имеете опыт построения внутренней платформы для других команд с self-service, API-контрактами, roadmap и метриками использования;

  • Умеете проектировать - декомпозиция систем, архитектурные решения и их защита, техническое ревью;

  • Готовы работать «наставником и архитектором», делегировать, растить инженеров и управлять через систему;

  • Имеете опыт работы со стейкхолдерами вроде DS-команд, продакт-менеджеров и смежных платформ.

Будет плюсом:

  • Разделение GPU в multi-tenant Kubernetes (MIG, HAMi, time-slicing);

  • vLLM и LLM-gateway в проде, учёт стоимости и качества LLM-проверок;

  • ClearML, Kubeflow или MLflow на уровне пайплайнов обучения и model registry;

  • Оптимизация инференса с TensorRT, ONNX Runtime и dynamic batching;

  • Опыт выделения платформенной команды из продуктовой с разделением зон ответственности и переносом дежурств.

Free account
Stop reading job ads. Get the ones that fit.
One free account turns this page into a shortlist built around your stack, your level and your pay.
Match on every job. Stack, seniority, pay and location, scored against your profile.
716,098 open roles. Read straight off company career pages, refreshed every day.
Unlimited applications. Every one you send is tracked in one place, on-site or on a company board.
3 tailored CVs a month. Rewritten for the exact job you are applying to. Included free.
Create a free account Continue with Google
Free forever. No card. Under a minute.

Your match

How well do you fit this role?
Two answers are enough for a real match. No account needed.
Check my fit
Answers stay in this browser until you create an account.

Recommended for you based on this role

Similar stack
Same company
Moscow
$32k – $86k per year (Estimated) • Remote • Moscow
Python
Databases
PostgreSQL
Milvus
pgvector
FAISS
Qdrant
AI/ML
vLLM
CUDA Toolkit
MLFlow
Triton Inference Server
Kubeflow
ClearML
KServe
CUDA
Triton
NCCL
InfiniBand
DevOps
Terraform
Ansible
Helm
Kubernetes
Amazon S3
Linux
Apply
$22k – $59k per year (Estimated) • In office • Moscow
Python
JavaScript
PHP
TypeScript
SQL
Node JS
1C
Python
FastAPI
PHP
Bitrix
Databases
PostgreSQL
Weaviate
pgvector
FAISS
Qdrant
ElasticSearch
OpenSearch
AI/ML
Copilot
LangGraph
LangChain
LlamaIndex
LoRA
vLLM
Fine-tuning
Multimodal AI
Function Calling
AI Agents
Ollama
PEFT
Semantic Kernel
YandexGPT
GigaChat
Gemini
LLM
RAG
OpenAI
Anthropic
Hugging Face
OCR
Structured Outputs
Tool Use
Frontend
Next.js
React.js
DevOps
Rest API
Git
Docker
Management
Confluence
Apply
AI Engineer 4 hours ago
$29k – $74k per year (Estimated) • In office • 3+ years exp • Bengaluru
Python
AI/ML
LangGraph
LangChain
Embeddings
NLP
LLM
RAG
Hugging Face
Recommender Systems
Agentic Workflows
Machine Learning
Apply
$103k – $244k per year (Estimated) • In office • London
Go
Java
Scala
Databases
Neo4j
AI/ML
Knowledge Graph
DevOps
GCP
Azure
CI/CD
AWS
Docker
Kubernetes
Apply
$78k per year (net) • In office • 5+ years exp • Moscow
Python
Java
AI/ML
AI Agents
Mobile
JUnit
DevOps
Rest API
Zabbix
CI/CD
Jenkins
Git
Docker
QA
Selenium
Playwright
Pytest
Apply
$32k – $86k per year (Estimated) • Remote • Moscow
Python
Databases
PostgreSQL
Milvus
pgvector
FAISS
Qdrant
AI/ML
vLLM
CUDA Toolkit
MLFlow
Triton Inference Server
Kubeflow
ClearML
KServe
CUDA
Triton
NCCL
InfiniBand
DevOps
Terraform
Ansible
Helm
Kubernetes
Amazon S3
Linux
Apply
MLOps Engineer (MLE) 5 hours ago
$32k – $86k per year (Estimated) • Remote • Moscow
Python
Python
FastAPI
Asyncio
Databases
PostgreSQL
ClickHouse
pgvector
Qdrant
Apache Kafka
OpenSearch
AI/ML
vLLM
MLFlow
Triton Inference Server
ONNX
TensorRT
Kubeflow
PyTorch
ClearML
KServe
Triton
TorchServe
ONNX Runtime
DevOps
gRPC
Terraform
Ansible
Helm
GitLab CI
Kubernetes
Error Budget
SLI/SLO/SLA
Apply
$27k – $63k per year (Estimated) • In office • 1+ year exp • Moscow
DevOps
Linux
Unix
TCP/IP
Apply
$36k – $88k per year (Estimated) • Remote • Moscow
AI/ML
Claude Code
NLP
VLM
Transformers
LLM
Apply
$50k – $101k per year (Estimated) • In office • 4+ years exp • Moscow
Python
SQL
Databases
Redis
ClickHouse
Apache Iceberg
Cassandra
Presto
Apache Kafka
Apache Hudi
Trino
Redpanda
AI/ML
Spark
Airflow
dbt
Flink
Feast
Machine Learning
DevOps
SLI/SLO/SLA
Amazon S3
Apply
$38k – $70k per year (Estimated) • Remote • 6+ years exp • Moscow
Databases
RabbitMQ
Apache Kafka
DevOps
Rest API
SOAP
Management
Confluence
Jira
Draw.io
UML
BPMN
QA
Swagger
Postman
Apply
$21k – $25k per year • In office • 1+ year exp • Moscow
Apply
$21k – $46k per year (Estimated) • Remote/Hybrid • 3+ years exp • Moscow
DevOps
Windows
Apply
$14k – $28k per year (Estimated) • Remote • Part-Time • Moscow
AI/ML
ChatGPT
Apply
$35k – $74k per year (Estimated) • In office • 3+ years exp • Moscow
Python
Python
FastAPI
AI/ML
MLFlow
Fine-tuning
Prompt Engineering
AI Agents
Mistral
Kubeflow
TensorFlow
PyTorch
LLM
RAG
Apply
See all jobs
This is one of many
716,098 more open roles from verified company boards, updated every day.