Location
Remote (EAEU)
Employment
Full-Time
Overview
Company
Impact
Profile match
Мы ищем инженера, который умеет разрабатывать собственные LLM-решения и разбираться в чужом коде: доводить до ума, чинить или переписывать. Нужен практик, понимающий модели изнутри и умеющий запускать их в продакшн (рассматриваем в том числе студентов).
Рассматриваем кандидатов из Санкт-Петербурга.
Что делать:
- Проектировать, обучать и дообучать модели (выбор архитектуры, fine tuning, квантизация, оптимизация инференса).
- Аудировать и исправлять решения подрядчиков - находить утечки, переобучение, ошибки в метриках и конфигах.
- Строить инфраструктуру обучения и инференса (Ollama, vLLM, TGI, GPU, Docker).
- Внедрять оценку качества: бенчмарки, LLM-as-judge, регрессионные тесты.
- Работать с данными: чистка, разметка, синтетика, версионирование.
- Собирать RAG и агентные сценарии (Hermes, tool calling, MCP), честно оценивать необходимость дообучения.
- Использовать облачные API (Claude, OpenAI, Gemini) в комбинации с локальными моделями.
- Применять агентные инструменты разработки (Claude Code, Cursor) и писать skills/инструкции для агентов.
- Развивать модели версия за версией: continual learning, merging, управление адаптерами, релизный цикл.
- Писать понятную техническую документацию.
Что нужно:
- Глубокое понимание трансформеров, обучения, оптимизации, регуляризации.
- Опыт дообучения LLM в продакшене (PyTorch, HF, PEFT, TRL, Unsloth, Axolotl).
- Квантизация и локальный запуск (GGUF, GPTQ, AWQ; Ollama, vLLM, llama.cpp).
- Уверенный Python, Git, Docker, Linux, рефакторинг чужого кода.
- Работа с датасетами (JSONL, чат-шаблоны, балансировка, чистка).
- Умение строить eval-наборы и интерпретировать метрики.
- Понимание лицензий, безопасности (PII, prompt injection), guardrails.
- Опыт с агентными фреймворками (LangGraph, OpenAI Agents, CrewAI) и API моделей (tool use, structured output, cost control).
- Практика с агентными средами разработки (Claude Code, Cursor) и написание skills.
- Опыт развития модели во времени (дообучение без забывания, слияние адаптеров, сравнение версий).
Будет плюсом:
- Приёмка аутсорсного ML-кода.
- Методы merging (SLERP, TIES, DARE), DPO/ORPO.
- Векторные БД и RAG (Qdrant, Chroma, LlamaIndex).
- Русскоязычные модели и корпуса.
- Мультимодальность, speech, CV.
- Навык объяснять технические вещи нетехническим людям.
Условия:
- Официальное трудоустройство по ТК РФ, полностью белая заработная плата
- Удаленный формат работы, график 5/2
- Стабильная заработная плата + премии, Мы ищем инженера, который умеет разрабатывать собственные LLM-решения и разбираться в чужом коде: доводить до ума, чинить или переписывать. Нужен практик, понимающий модели изнутри и умеющий запускать их в продакшн.
Что делать:
- Проектировать, обучать и дообучать модели (выбор архитектуры, fine tuning, квантизация, оптимизация инференса).
- Аудировать и исправлять решения подрядчиков - находить утечки, переобучение, ошибки в метриках и конфигах.
- Строить инфраструктуру обучения и инференса (Ollama, vLLM, TGI, GPU, Docker).
- Внедрять оценку качества: бенчмарки, LLM-as-judge, регрессионные тесты.
- Работать с данными: чистка, разметка, синтетика, версионирование.
- Собирать RAG и агентные сценарии (Hermes, tool calling, MCP), честно оценивать необходимость дообучения.
- Использовать облачные API (Claude, OpenAI, Gemini) в комбинации с локальными моделями.
- Применять агентные инструменты разработки (Claude Code, Cursor) и писать skills/инструкции для агентов.
- Развивать модели версия за версией: continual learning, merging, управление адаптерами, релизный цикл.
- Писать понятную техническую документацию.
Что нужно:
- Глубокое понимание трансформеров, обучения, оптимизации, регуляризации.
- Опыт дообучения LLM в продакшене (PyTorch, HF, PEFT, TRL, Unsloth, Axolotl).
- Квантизация и локальный запуск (GGUF, GPTQ, AWQ; Ollama, vLLM, llama.cpp).
- Уверенный Python, Git, Docker, Linux, рефакторинг чужого кода.
- Работа с датасетами (JSONL, чат-шаблоны, балансировка, чистка).
- Умение строить eval-наборы и интерпретировать метрики.
- Понимание лицензий, безопасности (PII, prompt injection), guardrails.
- Опыт с агентными фреймворками (LangGraph, OpenAI Agents, CrewAI) и API моделей (tool use, structured output, cost control).
- Практика с агентными средами разработки (Claude Code, Cursor) и написание skills.
- Опыт развития модели во времени (дообучение без забывания, слияние адаптеров, сравнение версий).
Будет плюсом:
- Приёмка аутсорсного ML-кода.
- Методы merging (SLERP, TIES, DARE), DPO/ORPO.
- Векторные БД и RAG (Qdrant, Chroma, LlamaIndex).
- Русскоязычные модели и корпуса.
- Мультимодальность, speech, CV.
- Навык объяснять технические вещи нетехническим людям.
Условия:
- Официальное трудоустройство по ТК РФ, полностью белая заработная плата
- Удаленный формат работы, график 5/2
- Стабильная заработная плата + премии
- Заработная плата - по результатам собеседования (обсуждается индивидуально)
- Испытательный срок - 3 месяца
Free account
Stop reading job ads. Get the ones that fit.
One free account turns this page into a shortlist built around your stack, your level and your pay.
Match on every job. Stack, seniority, pay and location, scored against your profile.
428,462 open roles. Read straight off company career pages, refreshed every day.
Unlimited applications. Every one you send is tracked in one place, on-site or on a company board.
3 tailored CVs a month. Rewritten for the exact job you are applying to. Included free.
Free forever. No card. Under a minute.
Your match
How well do you fit this role?
Two answers are enough for a real match. No account needed.
Check my fit
Answers stay in this browser until you create an account.
Recommended for you based on this role
Similar stack
Same company
Saint Petersburg
≈ $28k – $70k per year (Estimated) • In office • Full-Time • 7+ years exp • Bachelor's Degree • Hyderabad
Python
JavaScript
TypeScript
AI/ML
Claude
Claude Code
Model Context Protocol
AI Agents
NLP
Arize Phoenix
DeepEval
LangSmith
Promptfoo
LLM
RAG
Hallucination
LLM Evaluation
Agentic Workflows
Tool Use
Frontend
Angular
DevOps
GitHub Actions
CI/CD
AWS
Grafana
GitHub
Management
Jira
QA
Cypress
Playwright
Jest
Pytest
Apply
Intern - Automation, Operations Improvement
4 hours ago
≈ $49k – $75k per year (Estimated) • In office • Internship • Bachelor's Degree • Boise
Python
SQL
C#
Perl
Databases
Snowflake
Analytics
Tableau
Apply
PDE MCT Governance Senior Engineer
4 hours ago
≈ $24k – $53k per year (Estimated) • In office • Full-Time • 5+ years exp • Malaysia
Python
SQL
Analytics
Tableau
Power BI
Apply
SDET II (Python)
4 hours ago
≈ $12k – $34k per year (Estimated) • In office • 3+ years exp • Bachelor's Degree • Gurgaon
Python
SQL
DevOps
GitHub Actions
GitLab CI
CI/CD
Jenkins
Shift-Left
GitHub
GitLab
Cybersecurity
Shift-Left Security
QA
Selenium
JMeter
Playwright
Pytest
Locust
Apply
Staff Engineer
4 hours ago
≈ $42k – $90k per year (Estimated) • In office • Bengaluru
Python
Go
JavaScript
Java
Rust
C++
Node JS
Databases
Snowflake
Databricks
Management
Dropbox
Stripe
Apply
Графический дизайнер (Презентации)
1 day ago
≈ $13k – $30k per year (Estimated) • In office • Saint Petersburg
Design
Adobe Photoshop
Adobe Illustrator
Figma
Adobe InDesign
Apply
Golang-разработчик
1 day ago
≈ $19k – $50k per year (Estimated) • Remote • Full-Time • Saint Petersburg
Python
Go
PHP
Rust
SQL
DevOps
CI/CD
Apply
Java developer
1 day ago
≈ $13k – $26k per year (Estimated) • Remote/Hybrid • Full-Time • 2+ years exp • Saint Petersburg
Java
Java
Spring Framework
Spring Boot
Spring MVC
Gradle
JOOQ
Databases
PostgreSQL
Redis
ElasticSearch
Apache Kafka
DevOps
Ansible
Zabbix
Kibana
CI/CD
Jenkins
Git
Grafana
Bitbucket
Cybersecurity
SonarQube
Management
Confluence
Jira
QA
TestNG
Swagger
Apply
This is one of many
428,462 more open roles from verified company boards, updated every day.

