Обязанности
-
Мониторинг состояния инфраструктуры и сервисов: Grafana/Prometheus, Kubernetes, Linux-серверы и инфраструктурные компоненты;
-
Работа с логами и мониторингом: поиск ошибок и аномалий, обработка алертов, первичный анализ возникающих проблем;
-
Первичная диагностика инцидентов: сбор и анализ логов и метрик, локализация проблемы, выполнение базовых действий по устранению или эскалация;
-
Сопровождение Kubernetes-кластеров и работающих в них сервисов, выполнение типовых эксплуатационных операций;
-
Работа с инфраструктурными компонентами: PostgreSQL/Patroni, Redis/Sentinel, Ceph, HAProxy/Keepalived;
-
Сопровождение тестовых окружений и участие в проверке изменений перед внедрением в Production;
-
Работа с CI/CD и GitLab Runner: первичный анализ проблем сборки и деплоя;
-
Выполнение повседневных Linux и сетевых задач: диагностика сервисов, дисков, DNS, сетевой связности, сертификатов и доступности систем;
-
Участие в разборе инцидентов и подготовке post-mortem;
-
Ведение и актуализация технической документации, инструкций и инфраструктурных схем;
-
Работа с IaC и постепенная автоматизация повторяющихся эксплуатационных операций;
-
Взаимодействие с разработчиками и смежными техническими командами при решении инфраструктурных вопросов.
Требования
-
Базовое понимание Linux и желание развиваться в системном администрировании / DevOps / SRE;
-
Умение работать с Linux CLI и понимание базовых команд диагностики системы;
-
Базовое понимание компьютерных сетей: TCP/IP, DNS, HTTP/HTTPS, порты и сетевое взаимодействие;
-
Понимание принципов работы клиент-серверных приложений;
-
Базовые знания Git;
-
Способность читать техническую документацию и самостоятельно искать информацию;
-
Готовность разбираться в незнакомых системах и технологиях;
-
Внимательность при работе с инфраструктурой и понимание необходимости согласования потенциально опасных изменений;
-
Умение последовательно диагностировать проблему: собрать информацию, сформировать гипотезу и проверить её;
-
Адекватная коммуникация и готовность своевременно сообщать о проблемах и задавать вопросы.
Будет плюсом:
-
Практический опыт работы или домашние проекты с Docker и Kubernetes;
-
Знакомство с Grafana, Prometheus или другими системами мониторинга;
-
Знакомство с GitLab CI/CD;
-
Опыт работы с Ansible, Terraform или другими IaC/automation-инструментами;
-
Базовое знакомство с PostgreSQL, Redis, HAProxy, Ceph;
-
Опыт написания Bash/Python-скриптов;
-
Понимание принципов High Availability и отказоустойчивых систем;
-
Опыт работы системным администратором, инженером технической поддержки или эксплуатации;
-
Глубокий практический опыт со всем перечисленным стеком не требуется - ищем junior-специалиста с хорошей технической базой, системным мышлением и желанием развиваться в направлении Infrastructure / DevOps / SRE.
Условия
-
Конкурентная заработная плата - обсудим по итогам интервью;
-
Удаленный формат работы;
-
График 5/2: с 09:00 до 18:00 или с 10:00 до 19:00;
-
Предоставляем мощный рабочий ноутбук;
-
100% компенсация больничных;
-
Скидка на изучение английского языка в Skyeng.

