Salary
up to $42k per year (net)
Location
Remote (EAEU)
Seniority
Middle · 3+ years exp
Overview
Company
Impact
Profile match
2-Up is a Russian commercial organization active in the digital and technology services sector. It offers software-based solutions and online services that support customers in conducting and managing internet-based activities.
О проекте
2UP AI Platform - корпоративная AI SaaS-платформа для создания и развёртывания граф-агентов на базе LangGraph.
Платформа объединяет агентные сценарии, RAG, работу с несколькими LLM-провайдерами, корпоративные интеграции, мультитенантную архитектуру, потоковую генерацию ответов и инструменты наблюдаемости.
Мы ищем инженера, который сможет работать на стыке сильного Python backend и прикладной AI-разработки: развивать сервисы платформы, создавать LLM-агентов, улучшать RAG-пайплайны и доводить AI-функциональность до стабильного production.
Что предстоит делать
Backend и архитектура платформы
- Разрабатывать и развивать сервисы на Python и FastAPI.
- Проектировать API и внутреннюю архитектуру AI-платформы.
- Работать с асинхронным Python: asyncio, aiohttp, async-драйверы баз данных.
- Развивать pipeline обработки сообщений: инициализация, подготовка контекста, retrieval, вызов LLM, работа с инструментами, кэширование, метрики и форматирование ответа.
- Работать с MongoDB: модели данных, индексы, запросы, агрегации и оптимизация производительности.
- Использовать Redis для кэширования, хранения состояния и временных данных.
- Реализовывать WebSocket/SSE streaming ответов AI-агентов.
- Интегрировать корпоративные и внешние сервисы через API: Jira, Confluence, Google Workspace, S3, OAuth/OIDC и другие системы.
- Писать тесты, участвовать в code review и рефакторинге существующего кода.
LLM, агенты и RAG
- Разрабатывать AI-агентов и графовые workflow на LangGraph.
- Реализовывать StateGraph, tool calling, memory, управление контекстом, ветвлениями и обработкой ошибок.
- Создавать и улучшать RAG-пайплайны для работы с документами и корпоративными источниками знаний.
- Настраивать загрузку и обработку PDF, DOCX, PPTX, wiki, тикетов и других источников.
- Работать с чанкингом, метаданными, embeddings, векторным и гибридным поиском.
- Настраивать retrieval, reranking, фильтрацию и цитирование источников.
- Интегрировать разные LLM через OpenAI API, Anthropic API, OpenRouter, LiteLLM или аналогичные инструменты.
- Разрабатывать MCP-инструменты и подключать их к агентному фреймворку.
- Улучшать качество ответов и снижать количество галлюцинаций.
- Оптимизировать latency, стоимость запросов, размер контекста и выбор моделей.
Качество и эксплуатация
- Настраивать трассировку и наблюдаемость LLM-сценариев.
- Формировать наборы тестовых запросов и проводить регрессионные проверки.
- Использовать Langfuse, RAGAS, LLM-as-a-judge или аналогичные подходы.
- Участвовать в контейнеризации, CI/CD, мониторинге и логировании.
- Анализировать production-инциденты и повышать устойчивость AI-сервисов.
Обязательные требования
- От 3 лет коммерческого опыта backend-разработки на Python.
- Уверенное знание Python 3.11+.
- Практический опыт разработки production-сервисов на FastAPI, Flask, Django или аналогичных фреймворках.
- Опыт с асинхронным Python.
- Опыт работы с PostgreSQL и/или MongoDB.
- Практический опыт с Redis.
- Уверенная работа с Docker и docker-compose.
- Опыт интеграции внешних API.
- Опыт работы с LLM API и понимание особенностей LLM-систем.
- Практический опыт создания RAG-решений.
- Опыт с LangChain, LangGraph или аналогичными агентными фреймворками.
- Понимание embeddings, vector search, chunking, retrieval и reranking.
- Умение разбираться в существующем коде и развивать уже работающую систему.
Будет плюсом
- Опыт с Qdrant, pgvector, Pinecone, Weaviate или другими векторными хранилищами.
- Опыт с LightRAG, GraphRAG или agentic RAG.
- Практический опыт с Langfuse, LangSmith, RAGAS.
- Опыт разработки MCP-серверов и инструментов.
- Опыт с LiteLLM и несколькими LLM-провайдерами.
- Опыт с Keycloak, OAuth2, OIDC и JWT.
- Опыт разработки мультитенантных SaaS-систем.
- Опыт с S3/MinIO.
- Знание Prometheus, Grafana, Sentry, OpenTelemetry.
- Опыт с Kubernetes и CI/CD.
- Опыт self-hosted LLM, vLLM, Ollama или Hugging Face.
- Опыт fine-tuning моделей через LoRA/QLoRA.
Кого мы ищем
Нам подойдёт инженер, который:
- не ограничивается прототипами и умеет доводить решения до production;
- одинаково уверенно чувствует себя в backend-разработке и AI-интеграциях;
- понимает, что качество AI-системы зависит не только от промпта, но и от архитектуры, данных, retrieval, наблюдаемости и обработки ошибок;
- умеет принимать технические решения с учётом качества, скорости, стоимости и дальнейшего масштабирования;
- готов работать с существующей кодовой базой, а не только создавать решения с нуля.
Условия
- Работа над собственной корпоративной AI-платформой.
- Удалённый или гибридный формат.
- Полная занятость.
- Возможность влиять на архитектуру продукта и технические решения.
- Задачи на стыке backend, LLM, RAG и AI Agents.
- Оформление и уровень дохода обсуждаются индивидуально.
Процесс отбора
- Короткое знакомство с HR.
- Техническое интервью с командой.
- Финальная встреча с руководителем.
Free account
Stop reading job ads. Get the ones that fit.
One free account turns this page into a shortlist built around your stack, your level and your pay.
Match on every job. Stack, seniority, pay and location, scored against your profile.
368,530 open roles. Read straight off company career pages, refreshed every day.
Unlimited applications. Every one you send is tracked in one place, on-site or on a company board.
3 tailored CVs a month. Rewritten for the exact job you are applying to. Included free.
Free forever. No card. Under a minute.
Your match
How well do you fit this role?
Two answers are enough for a real match. No account needed.
Check my fit
Answers stay in this browser until you create an account.
Recommended for you based on this role
Similar stack
Same company
Moscow
Cloud DevOps and AI Security Engineer
1 day ago
$68k – $85k per year • In office • Full-Time • Master's Degree • San Jose
Python
AI/ML
AI Agents
DevOps
Amazon EC2
AWS
AWS Lambda
Bitbucket
CI/CD
CloudFormation
Docker
Git
Kubernetes
Terraform
Amazon S3
IAM
HPC
Cybersecurity
Least Privilege
Apply
Application Security Engineer
1 day ago
$185k – $260k per year • Remote • Full-Time • 8+ years exp • Bachelor's Degree
DevOps
AWS
CI/CD
GCP
Kubernetes
GitHub
Cybersecurity
Clair
Dependabot
OWASP Top 10
OWASP ZAP
Snyk
Trivy
Apply
FPGA Verification Engineer II
1 day ago
$118k – $142k per year • In office • Full-Time • 2+ years exp • Bachelor's Degree • El Segundo
C++
MATLAB
Python
SystemC
SystemVerilog
Verilog
VHDL
DevOps
CI/CD
QEMU
Chips/EDA
UVM
Apply
≈ $129k – $232k per year (Estimated) • In office • Full-Time • 5+ years exp • Bachelor's Degree • Austin
C++
DevOps
CI/CD
Git
RTOS
Apply
Senior Flight Software Engineer
1 day ago
$133k – $161k per year • In office • Full-Time • 5+ years exp • Bachelor's Degree • Westminster
C++
Python
DevOps
CI/CD
SpaceTech
NASA cFS
Apply
Bi-аналитик (Data Platform)
1 hour ago
≈ $21k – $44k per year (Estimated) • Remote • Full-Time • 3+ years exp • Moscow
Python
SQL
Databases
ClickHouse
PostgreSQL
AI/ML
Airflow
DevOps
Amazon S3
Apply
$21k – $35k per year • In office • Moscow
Bash
Python
Databases
MySQL
PostgreSQL
DevOps
Ansible
Debian
Grafana
Proxmox VE
Ubuntu
Zabbix
Apply
≈ $11k – $22k per year (Estimated) • In office • Full-Time • Moscow
Management
Confluence
Jira
Apply
Аналитик поддержки
2 hours ago
≈ $33k – $81k per year (Estimated) • In office • Full-Time • Moscow
Management
Confluence
Jira
Apply
Middle Data Scientist (классический ML)
3 hours ago
≈ $41k – $76k per year (Estimated) • In office • Full-Time • Moscow
Python
SQL
Python
pySpark
AI/ML
CatBoost
Hadoop
NLP
NumPy
Spark
DevOps
CI/CD
Apply
This is one of many
368,530 more open roles from verified company boards, updated every day.

