О роли
Мы ищем Senior DevOps-инженера, который станет ключевым участником команды, отвечающей за развитие, надежность и безопасность инфраструктуры компании.
Эта роль предполагает не только сопровождение существующих платформ, но и проектирование новых инфраструктурных решений, автоматизацию процессов разработки и эксплуатации, а также внедрение современных инженерных практик.
Вы будете работать на стыке разработки, эксплуатации и информационной безопасности, обеспечивая стабильную работу высоконагруженных сервисов, масштабируемость платформы и непрерывность процессов доставки изменений.
Важной частью роли станет развитие Kubernetes-экосистемы, построение надежных CI/CD-процессов, управление инфраструктурой как кодом, повышение уровня наблюдаемости сервисов и внедрение лучших практик DevSecOps.
Техническая экспертиза
Операционные системы и сети
- Уверенное администрирование Linux (Rocky, Debian, Ubuntu).
- Настройка systemd, LVM, sysctl, диагностика производительности.
- Глубокое понимание TCP/IP, маршрутизации, VLAN, NAT, VPN (WireGuard, IPsec).
- Диагностика сетевых проблем с использованием tcpdump, ss, Wireshark.
- Настройка nftables / iptables и Kubernetes Network Policies.
Контейнеризация и Kubernetes
- Практический опыт работы с Docker, оптимизацией Docker-образов и многоступенчатыми Dockerfile.
- Опыт развертывания и эксплуатации Kubernetes-кластеров (kubeadm или managed Kubernetes).
- Уверенное владение Helm, разработкой собственных chart'ов и управлением зависимостями.
- Практический опыт использования Cilium, Network Policies, eBPF и Hubble.
Виртуализация и инфраструктура
- Опыт работы с KVM, libvirt, Proxmox или OpenStack.
- Практический опыт использования Terraform (modules, state, workspaces).
- Опыт управления инфраструктурой как кодом.
CI/CD и автоматизация
- Опыт построения CI/CD-пайплайнов в GitLab CI, GitHub Actions или Jenkins.
- Интеграция процессов сборки и деплоя с Helm, Terraform и Vault.
- Автоматизация доставки изменений в Kubernetes (GitOps или push-based deployment).
Безопасность
- Опыт внедрения HashiCorp Vault и управления секретами.
- Настройка политик доступа и интеграция Vault с Kubernetes.
- Практический опыт работы с Wazuh.
- Опыт использования Falco, Trivy или Grype для обеспечения безопасности контейнеров.
- Работа с Kyverno или аналогичными инструментами Policy as Code.
- Понимание принципов least privilege, patch management и безопасной эксплуатации инфраструктуры.
Мониторинг и наблюдаемость
- Опыт настройки Prometheus и VictoriaMetrics.
- Практический опыт работы с ELK Stack (Filebeat, Logstash, Kibana).
- Создание дашбордов, мониторинга и систем оповещения.
Хранение данных и базы
- Опыт эксплуатации CloudNative-PG.
- Настройка репликации, резервного копирования и восстановления PostgreSQL.
- Практический опыт работы с Kubernetes Storage (Ceph, Longhorn или Mayastor).
- Понимание StorageClass, Persistent Volumes, PVC, snapshots и расширения томов.
Service Mesh и отказоустойчивость
- Практический опыт работы с Istio или Linkerd.
- Настройка mTLS, traffic management, canary и blue-green deployment.
- Опыт резервного копирования Kubernetes с использованием Velero.
- Настройка Disaster Recovery и восстановления кластеров.
Будет преимуществом
- Практический опыт GitOps (ArgoCD или Flux).
- Опыт работы с Talos OS в production.
- Понимание eBPF и разработки Kubernetes Operators.
- Наличие сертификатов CKA, CKAD, CKS или Vault Associate.
Личные качества
- Системное и инженерное мышление.
- Высокая ответственность за стабильность и надежность инфраструктуры.
- Проактивный подход к автоматизации и безопасности.
- Умение принимать решения в условиях высокой нагрузки и быстро реагировать на инциденты.
- Способность структурировать знания и поддерживать техническую документацию.
- Развитые навыки коммуникации и эффективного взаимодействия с командами разработки и эксплуатации.

