Привет!
Мы команда Infrastructure & Operations. Создаем PaaS-платформу для работы с Data Services: ClickHouse, Redis/Valkey, PostgreSQL, Kafka и другими хранилищами. Наша миссия состоит в том, чтобы сделать эти сервисы простой, надежной и стандартизированной частью внутренней платформы, на которой команды смогут самостоятельно, быстро и безопасно запускать и развивать свои продукты. С ростом нагрузки и требований к автоматизации мы расширяем команду и ищем Kubernetes Platform Engineer уровня Middle+/Senior. Ты будешь развивать платформу и Data Services как продукт: проектировать компоненты, стандарты и инструменты, которыми пользуются десятки команд разработки. Основной фокус роли: платформенные решения для ClickHouse и Redis/Valkey.
Наш стек
Kubernetes, ClickHouse, Redis/Valkey, GitLab CI/CD, Vault, Terraform, S3, Terraform, Ansible.
Задачи, которыми тебе предстоит заниматься?
- Участвовать в архитектурных решениях, проектировании, развитии и эксплуатации PaaS-платформы на базе Kubernetes, включая компоненты ClickHouse и Redis/Valkey
- Автоматизировать жизненный цикл Data Services: развертывание, масштабирование, миграции, обновления, резервное копирование, репликацию и восстановление
- Создавать и развивать решения самообслуживания для команд разработки
- Стандартизировать и развивать платформенные практики: Service Catalog, SLO/SLA, GitOps и IaC
- Участвовать в устранении инцидентов, анализировать стабильность и производительность платформы
- В первую очередь предстоит развивать платформенные компоненты для ClickHouse и Redis/Valkey, формировать стандартные сценарии их предоставления и эксплуатации в Kubernetes.
Что потребуется для работы?
- Понимание Kubernetes как платформы: архитектуры control plane и data plane, жизненного цикла объектов, примитивов нагрузки Deployments, StatefulSets и DaemonSets, механизмов контроля и reconciliation.
- Уверенное знание Kubernetes storage stack: StorageClass, PVC/PV, особенности stateful-нагрузок, репликация и отказоустойчивость
- Практический опыт эксплуатации и тюнинга ClickHouse от 3х лет: репликация, шардирование, ClickHouse Keeper, оптимизация запросов и хранения, резервное копирование и восстановление.
- Практический опыт эксплуатации Redis или Valkey: репликация, Sentinel или Cluster, механизмы персистентности, переключение при отказах, оптимизация памяти и задержек.
- Опыт развертывания и эксплуатации stateful-операторов Kubernetes для ClickHouse и Redis/Valkey или участие в разработке и кастомизации собственных операторов.
- Опыт работы с Terraform и понимание принципов IaC.
- Опыт построения CI/CD pipelines для инфраструктурных компонентов.
- Практическое владение GitOps-подходом, например Argo CD или Flux, и умение проектировать процессы развертывания платформенных компонентов.
- Понимание процессов Software Development.
Что еще пригодиться?
- Опыт решения эксплуатационных задач, связанных с кластеризацией, высокой доступностью, backup/restore и производительностью других Data Services в Kubernetes.
- Опыт разработки Kubernetes-операторов и контроллеров на Go или Python.
- Опыт работы с multi-tenancy в Kubernetes.
- Знание принципов распределенных систем: CAP, Raft, quorum и consensus.
- Опыт участия в архитектурных обсуждениях и принятии решений при построении PaaS/DBaaS.
- Опыт работы с policy-as-code: OPA, Gatekeeper или Kyverno.
- Экспертиза в observability-стеке: Prometheus, Grafana, VictoriaMetrics и Jaeger, умение строить метрики и алерты для Kubernetes и Data Services.
- Умение находить корневые причины инцидентов, связанных с latency, IO bottlenecks, сетью и потреблением памяти
- Опыт работы с Helm и проектирования production-чартов
Что у нас?
- 2ГИС - аккредитованная IT-компания.
- Работать можно в офисе или удалённо, как удобнее. Если хочешь работать в гибридном формате, у нас есть офисы в Москве, Санкт-Петербурге, два классных офиса в Новосибирске. Удалённо - из любого города России.
- Само собой, полностью белая зарплата.
- Заботимся о здоровье: ДМС и возможность получать онлайн-консультации терапевта, невролога, психолога и медицинского агента.
- Если хочешь делиться своим опытом, мы только за - поможем с выступлениями на конференциях и статьями для Хабра.
- Есть собственный учебный центр: курсы, тренинги и книги для прокачки скиллов.

