{"id":1954266,"url":"https://alion.io/job/vk-senior-site-reliability-engineer","title":"Senior Site Reliability Engineer","company":{"id":151,"name":"VK","domain":"vk.com","url":"https://alion.io/company/vk","size_band":"201-500","is_staffing_agency":false,"employer_type":"direct","is_intermediary":false,"listed_via":null,"ats_vendor":"HeadHunter","truth_index":{"grade":"B","score":81,"open_postings":25,"ghost_share":0.16,"stale_share":0,"repost_share":0.64,"time_to_fill_p50_days":26,"computed_at":"2026-10-10T05:45:15Z"}},"role":"DevOps","role_family":"DevOps","seniority":"senior","employment_type":null,"work_mode":"remote","remote_scope":"stated_regions","remote_scope_basis":"inferred_company_offices","remote_working_hours":null,"hiring_geo_confidence":"inferred","locations":["Moscow, Russia"],"countries":["RU"],"hiring_countries":["RU","BY","KZ","KG","AM"],"hiring_countries_total":5,"salary":null,"salary_estimate":{"min_usd":30000,"max_usd":58000,"period":"year","method":"role_seniority_country_remote_cell","sample_n":14},"experience_years_min":5,"visa_sponsorship":false,"relocation_package":false,"has_equity":false,"technologies":[{"name":"Alertmanager","optional":false},{"name":"Ansible","optional":false},{"name":"Bash","optional":false},{"name":"Blue-Green Deployment","optional":false},{"name":"CI/CD","optional":false},{"name":"DNS","optional":false},{"name":"Error Budget","optional":false},{"name":"Git","optional":false},{"name":"Grafana","optional":false},{"name":"Graylog","optional":false},{"name":"IAM","optional":false},{"name":"Java","optional":false},{"name":"Kubernetes","optional":false},{"name":"Linux","optional":false},{"name":"Prometheus","optional":false},{"name":"Python","optional":false},{"name":"SLI/SLO/SLA","optional":false},{"name":"TCP/IP","optional":false},{"name":"Terraform","optional":false},{"name":"Apache Kafka","optional":true},{"name":"ClickHouse","optional":true},{"name":"Least Privilege","optional":true},{"name":"PostgreSQL","optional":true},{"name":"Redis","optional":true}],"status":"live","first_seen_at":"2026-10-06T11:30:57Z","employer_posted_date":"2026-10-06","last_verified_at":"2026-10-11T09:12:47Z","board_verified":true,"closed_at":null,"days_open":5,"trust":{"level":"ok","repost_count":null,"flags":[],"days_open":5},"description":"Задачи\n Развивать и сопровождать инфраструктуру highload-системы, повышать надёжность, доступность и производительность\n Внедрять и поддерживать SLO/SLI и практики error budget, выстраивать алертинг на основе пользовательских метрик и приоритизации\n Развивать observability (Prometheus/Alertmanager, Grafana, централизованные логи): делать эксплуатационные дашборды, настраивать алерты, снижать alert noise, улучшать MTTD/MTTR\n Автоматизировать рутинные операции и эксплуатационные процессы, снижать toil, развивать self-service подходы для команд разработки\n Участвовать в on-call, оперативно реагировать и устранять инциденты, координировать восстановление, проводить postmortem и доводить улучшения до продакшена\n Взаимодействовать с командами разработки и смежными инфраструктурными командами: участвовать в архитектурных обсуждениях, ревью изменений, согласовании требований к production readiness\n Вести и развивать эксплуатационную документацию: писать и актуализировать runbooks/playbooks для типовых инцидентов и деградаций, инструкции по релизам/роллбэкам и аварийным процедурам (в том числе DR), документировать дашборды/алерты и схемы зависимостей/эскалаций\n Требования\n Опыт 5+ лет в SRE/DevOps/Platform/System Engineering, опыт эксплуатации highload -систем\n Глубокие знания Linux: администрирование, диагностика производительности (CPU/mem/io), анализ деградаций, systemd, файловые системы, лимиты/квоты, troubleshooting на production\n Сетевые основы для диагностики: TCP/IP, DNS, HTTP/HTTPS, TLS, L4/L7 балансировка, keepalive; умение находить и устранять сетевые причины деградаций\n Опыт эксплуатации распределённых систем: понимание partial failures, timeouts/retries, backpressure, graceful degradation\n Облака: опыт эксплуатации инфраструктуры в публичном облаке - сети и балансировщики, autoscaling, IAM/роль-модель; построение отказоустойчивости по зонам/регионам, базовые DR-подходы\n Контейнеры и Kubernetes: понимание контейнеризации и практический опыт работы с Kubernetes на уровне эксплуатации (деплой, конфигурации, диагностика проблем приложений/окружения)\n Infrastructure as Code: Terraform (или аналог) + Ansible; Git-workflow, code review, версионирование инфраструктуры\n CI/CD и управление изменениями: безопасные релизы (canary/blue-green), rollback стратегии, снижение рисков изменений\n Код и автоматизация: чтение чужого кода (Go/Java/Python) для диагностики; написание автоматизации (Python/Go/Bash), создание утилит/джоб для эксплуатации\n Observability: Prometheus/Alertmanager, Grafana, централизованные логи (Graylog/ELK) - дашборды под эксплуатацию, алерты с учётом снижения шума и приоритизации\n SRE-практики: SLI/SLO, error budget, incident response, postmortem без поиска виноватых\n Готовность к on-call и участие в разборе и устранении инцидентов\n Навыки создания и поддержки эксплуатационной документации: runbooks/playbooks, инструкции по деплою/роллбэку, схемы архитектуры, описания SLO/алертов; умение писать кратко и так, чтобы документ работал в инциденте\n Будет плюсом\n Опыт с БД/кешами/очередями: PostgreSQL/Redis/Cassandra/Kafka/ClickHouse и так далее\n Сопровождение Java: JVM/GC, heap/thread dumps, профилирование, диагностика latency\n Security basics: secrets management, least privilege","description_format":"text","description_chars":3243,"description_truncated":false,"requirements":{"experience_years_min":5,"management_years_min":null,"team_size_min":null,"manages_managers":false,"education":null,"security_clearance":false,"languages":[{"language":"Russian","level":"Advanced (C1)","optional":false}]},"benefits":[],"hiring_locations":[{"name":"Russia","iso":"RU","kind":"country"},{"name":"Belarus","iso":"BY","kind":"region"},{"name":"Kazakhstan","iso":"KZ","kind":"region"},{"name":"Kyrgyzstan","iso":"KG","kind":"region"},{"name":"Armenia","iso":"AM","kind":"region"}],"hiring_excludes":[],"relocation_offered":false,"industries":["Email Hosting & Delivery","Social Networks","Video & Photo Sharing","Consumer Internet Groups"],"lifecycle":[{"event":"open","at":"2026-10-06T11:35:10Z"}],"visa":[],"liveness":{"score":90,"band":"hot","label":"Hiring now","p_open":1,"p_active":0.903,"p_room":1,"age_days":3,"expected_fill_days":26,"reasons":["conf:2","velocity","win:early"],"computed_at":"2026-10-10T05:45:15Z"},"pay":null,"html_url":"https://alion.io/job/vk-senior-site-reliability-engineer","json_url":"https://alion.io/job/vk-senior-site-reliability-engineer.json","meta":{"generated_at":"2026-10-11T23:36:01Z","cache_seconds":300,"methodology":"https://alion.io/methodology","terms":"https://alion.io/terms","contact":"https://alion.io/contact","api":"https://alion.io/developers","about":"Alion is a live layer of people, companies and AI agents: who they are, whether they are real and active right now, what they do and how to work with them, readable by people and by agents and paid per call.","catalog":"https://alion.io/catalog.json","usage":{"tier":"crawler_verified","counted_by":"address","units_charged":1,"used_today":14691,"day_limit":null,"remaining_today":null,"minute_limit":300,"resets_at":"2026-10-12T00:00:00Z"}},"offers":[{"id":"company.slices","title":"One company in depth, by slice","status":"live","price":{"credits":0.02,"usd":0.002,"plus_per_slice":{"credits":0.05,"usd":0.005}},"unit":"per company, plus each slice with data","note":"the employer in depth","call":{"mcp_tool":"get_company","arguments":{"id":151},"rest":"https://alion.io/mcp/rest/get_company?id=151"},"human":"https://alion.io/catalog?offer=company.slices&for=job%2Fvk-senior-site-reliability-engineer"},{"id":"market.stats","title":"A market slice: pay, demand and time to fill","status":"live","price":{"credits":1,"usd":0.1},"unit":"per slice","note":"pay, demand and time to fill for this role and place","call":{"mcp_tool":"market_stats"},"human":"https://alion.io/catalog?offer=market.stats&for=job%2Fvk-senior-site-reliability-engineer"},{"id":"job.search","title":"Open jobs by role, technology, place, pay and visa","status":"live","price":{"credits":0.02,"usd":0.002},"unit":"per posting in a list","note":"similar open postings","call":{"mcp_tool":"search_jobs"},"human":"https://alion.io/catalog?offer=job.search&for=job%2Fvk-senior-site-reliability-engineer"},{"id":"company.verify","title":"Is this company real and active right now","status":"pilot","price":null,"unit":"per company","request":{"url":"https://alion.io/catalog/request","method":"POST","body":"{\"offer\": \"company.verify\", \"for\": \"job/vk-senior-site-reliability-engineer\", \"note\": \"what you need it for\"}"},"human":"https://alion.io/catalog?offer=company.verify&for=job%2Fvk-senior-site-reliability-engineer"}]}