Привет! Меня зовут Эля, я HR компании «Амбрелла».
Мы - аккредитованная IT-компания в сфере информационной безопасности. Развиваем высоконагруженную SIEM-платформу для сбора, хранения и обработки событий ИБ.
Сейчас ищем DevOps / SRE-инженера уровня Middle+/Senior с глубокой практической экспертизой по ClickHouse и уверенным опытом эксплуатации MariaDB.
Основной фокус роли - промышленная эксплуатация ClickHouse: кластеры, репликация, шардирование, производительность, хранение больших объёмов данных, backup/restore, мониторинг, безопасность и безопасное проведение изменений в production.
Вторая важная зона -
MariaDB: эксплуатация, репликация, отказоустойчивость, Galera Cluster, backup/restore, disaster recovery, performance tuning и миграция с master-master-репликации на более надёжную кластерную архитектуру.
Нам нужен инженер, который умеет не просто «поднять базу», а безопасно эксплуатировать production-инфраструктуру с критически важными данными: проверять гипотезы на стендах, оценивать риски, готовить rollback-план, участвовать в расследовании инцидентов и фиксировать результаты в документации.
Чем предстоит заниматься:
ClickHouse:
- Администрировать продуктивные и тестовые кластеры ClickHouse;
- Контролировать состояние шардов, реплик, Distributed-таблиц и ReplicatedMergeTree-таблиц;
- Диагностировать replication queue, merges, mutations, inserts, деградацию запросов и проблемы с дисковой подсистемой;
- Анализировать системные таблицы ClickHouse и состояние кластера;
- Участвовать в изменении топологии кластера: добавление шардов, реплик, серверов, изменение Distributed-таблиц;
- Планировать горизонтальное масштабирование ClickHouse-кластера;
- Оптимизировать схемы данных, партиционирование, ключи сортировки, TTL, индексы, storage policy и настройки сервера;
- Работать с хранением данных: локальные диски, LUN, DAS, hot / warm storage, S3-совместимое хранилище;
- Прорабатывать дедупликацию данных, повышение уровня сжатия и механизм токенизации / full text search по событиям;
- Настраивать и сопровождать ClickHouse Keeper / ZooKeeper;
- Настраивать TLS/SSL для клиентских подключений и межсерверного взаимодействия;
- Разрабатывать и проверять backup/restore и disaster recovery;
- Настраивать мониторинг, алерты и дашборды по ClickHouse;
- Готовить Ansible playbooks / roles, runbook’и, инструкции, чек-листы и технические отчёты.
MariaDB:
- Администрировать продуктивные и тестовые инсталляции MariaDB;
- контролировать состояние серверов, репликации, соединений, транзакций, блокировок и фоновых процессов;
- Настраивать и сопровождать репликацию: master-slave, master-master, GTID-based replication;
- Диагностировать replication lag, ошибки SQL thread / IO thread, рассинхронизацию данных и конфликты при master-master-схемах;
- Участвовать в миграции MariaDB с master-master-репликации на Galera Cluster;
- Настраивать, сопровождать и диагностировать Galera Cluster;
- Прорабатывать HA-архитектуру MariaDB: failover, fencing, VIP / proxy layer, split-brain-риски;
- Разрабатывать и проверять disaster recovery-сценарии, RPO / RTO и восстановимость резервных копий;
- Анализировать производительность: slow queries, EXPLAIN, индексы, locks, deadlocks, buffer pool, connection pool, disk IO;
- Оптимизировать конфигурацию MariaDB с учётом нагрузки, объёма данных, RAM, CPU, дисковой подсистемы и сети;
- Настраивать TLS/SSL для клиентских подключений и репликации;
- Настраивать мониторинг, алерты, дашборды и runbook’и по MariaDB.
Production, автоматизация и взаимодействие:
- Участвовать в расследовании production-инцидентов, связанных с ClickHouse, MariaDB, Linux, сетью или дисковой подсистемой;
- Анализировать метрики, логи, системные таблицы, состояние репликации, блокировки, диски, сеть и конфигурации;
- Формулировать технические гипотезы, проверять их и отделять пер"}
Вакансии
Специалисты
Кандидатам
Работодателям
Вакансии
Специалисты
Кандидатам
Работодателям
menu
UM
DevOps / SRE-инженер с экспертизой ClickHouse и MariaDB
Прямой работодатель Umbrella.moscow( umbrella.moscow )
Сеньор
- Тимлид/Руководитель группы
Информационные технологии
- DevOps
- ClickHouse
- MariaDB
- SaaS/PaaS
9 сентября
Опыт работы любой
Работодатель Umbrella.moscow
Короткая ссылка: geekjob.ru/hihh
Откликнуться
Описание вакансии
Привет! Меня зовут Эля, я HR компании «Амбрелла».
Мы - аккредитованная IT-компания в сфере информационной безопасности. Развиваем высоконагруженную SIEM-платформу для сбора, хранения и обработки событий ИБ.
Сейчас ищем DevOps / SRE-инженера уровня Middle+/Senior с глубокой практической экспертизой по ClickHouse и уверенным опытом эксплуатации MariaDB.
Основной фокус роли - промышленная эксплуатация ClickHouse: кластеры, репликация, шардирование, производительность, хранение больших объёмов данных, backup/restore, мониторинг, безопасность и безопасное проведение изменений в production.
Вторая важная зона -
MariaDB: эксплуатация, репликация, отказоустойчивость, Galera Cluster, backup/restore, disaster recovery, performance tuning и миграция с master-master-репликации на более надёжную кластерную архитектуру.
Нам нужен инженер, который умеет не просто «поднять базу», а безопасно эксплуатировать production-инфраструктуру с критически важными данными: проверять гипотезы на стендах, оценивать риски, готовить rollback-план, участвовать в расследовании инцидентов и фиксировать результаты в документации.
Чем предстоит заниматься:
ClickHouse:
- Администрировать продуктивные и тестовые кластеры ClickHouse;
- Контролировать состояние шардов, реплик, Distributed-таблиц и ReplicatedMergeTree-таблиц;
- Диагностировать replication queue, merges, mutations, inserts, деградацию запросов и проблемы с дисковой подсистемой;
- Анализировать системные таблицы ClickHouse и состояние кластера;
- Участвовать в изменении топологии кластера: добавление шардов, реплик, серверов, изменение Distributed-таблиц;
- Планировать горизонтальное масштабирование ClickHouse-кластера;
- Оптимизировать схемы данных, партиционирование, ключи сортировки, TTL, индексы, storage policy и настройки сервера;
- Работать с хранением данных: локальные диски, LUN, DAS, hot / warm storage, S3-совместимое хранилище;
- Прорабатывать дедупликацию данных, повышение уровня сжатия и механизм токенизации / full text search по событиям;
- Настраивать и сопровождать ClickHouse Keeper / ZooKeeper;
- Настраивать TLS/SSL для клиентских подключений и межсерверного взаимодействия;
- Разрабатывать и проверять backup/restore и disaster recovery;
- Настраивать мониторинг, алерты и дашборды по ClickHouse;
- Готовить Ansible playbooks / roles, runbook'и, инструкции, чек-листы и технические отчёты.
MariaDB:
- Администрировать продуктивные и тестовые инсталляции MariaDB;
- контролировать состояние серверов, репликации, соединений, транзакций, блокировок и фоновых процессов;
- Настраивать и сопровождать репликацию: master-slave, master-master, GTID-based replication;
- Диагностировать replication lag, ошибки SQL thread / IO thread, рассинхронизацию данных и конфликты при master-master-схемах;
- Участвовать в миграции MariaDB с master-master-репликации на Galera Cluster;
- Настраивать, сопровождать и диагностировать Galera Cluster;
- Прорабатывать HA-архитектуру MariaDB: failover, fencing, VIP / proxy layer, split-brain-риски;
- Разрабатывать и проверять disaster recovery-сценарии, RPO / RTO и восстановимость резервных копий;
- Анализировать производительность: slow queries, EXPLAIN, индексы, locks, deadlocks, buffer pool, connection pool, disk IO;
- Оптимизировать конфигурацию MariaDB с учётом нагрузки, объёма данных, RAM, CPU, дисковой подсистемы и сети;
- Настраивать TLS/SSL для клиентских подключений и репликации;
- Настраивать мониторинг, алерты, дашборды и runbook'и по MariaDB.
Production, автоматизация и взаимодействие:
- Участвовать в расследовании production-инцидентов, связанных с ClickHouse, MariaDB, Linux, сетью или дисковой подсистемой;
- Анализировать метрики, логи, системные таблицы, состояние репликации, блокировки, диски, сеть и конфигурации;
- Формулировать технические гипотезы, проверять их и отделять первопричину от сопутствующих факторов;
- Готовить технические выводы по итогам инцидентов и участвовать в postmortem-разборах;
- Разворачивать тестовые стенды ClickHouse и MariaDB для проверки архитектурных решений;
- Проверять обновления, изменение топологии, расширение хранилища, storage policy и параметры ClickHouse / MariaDB до применения в production;
- Автоматизировать типовые операции через Ansible / Bash / Python / Terraform или аналогичные инструменты;
- Взаимодействовать с заказчиками, объяснять технические риски понятным языком, предлагать решения и лидировать технические обсуждения.
Обязательные требования:
- Практический опыт промышленной эксплуатации ClickHouse;
- Понимание архитектуры ClickHouse: shards, replicas, Distributed tables, ReplicatedMergeTree, MergeTree family;
- Опыт диагностики replication queue, merges, mutations, insert/select latency, деградации запросов и проблем с дисковой подсистемой;
- Понимание партиционирования, ключей сортировки, TTL, storage policies, disks, volumes, data skipping indexes;
- Опыт изменения топологии ClickHouse-кластера или глубокое понимание порядка и рисков таких изменений;
- Опыт настройки TLS/SSL для ClickHouse;
- Опыт эксплуатации MariaDB в продуктивной или близкой к продуктивной среде;
- Понимание MariaDB, InnoDB, транзакций, индексов, блокировок, deadlocks, isolation levels;
- Опыт настройки и диагностики репликации MariaDB;
- Понимание GTID, binary logs, relay logs, replication lag, failover и рисков master-master-репликации;
- Опыт настройки backup/restore MariaDB и проверки восстановимости резервных копий;
-Опыт диагностики производительности MariaDB: slow query log, EXPLAIN, индексы, locks, buffer pool, disk IO;
- Опыт эксплуатации Linux-серверов;
- Понимание влияния CPU, RAM, disk IO, network и filesystem на работу ClickHouse и MariaDB;
- Опыт настройки мониторинга и алертов для ClickHouse, MariaDB и инфраструктуры;
- Опыт работы с Prometheus, Grafana, Zabbix или аналогичными системами мониторинга;
- Опыт автоматизации через Ansible, Bash, Python или аналогичные инструменты;
- Умение аккуратно проводить изменения в production: план работ, оценка рисков, rollback-план, проверка результата;
- Умение писать техническую документацию: инструкции, runbook'и, чек-листы, postmortem-отчёты.
Желательные требования:
- Опыт или уверенное понимание Galera Cluster;
- Опыт эксплуатации ClickHouse и MariaDB в составе SIEM, SOC, log management, observability, telemetry или других высоконагруженных систем;
- Опыт работы с большими объёмами данных: десятки или сотни ТБ;
- Опыт работы с ClickHouse Keeper или ZooKeeper;
- Опыт эксплуатации ClickHouse / MariaDB на bare metal;
- Опыт работы с LUN, DAS, локальными дисковыми массивами и S3-совместимыми объектными хранилищами;
- Опыт нагрузочного тестирования ClickHouse и MariaDB;
- Опыт построения процедур disaster recovery;
- Опыт подготовки архитектурных и эксплуатационных документов для заказчиков;
- Опыт работы с ProxySQL, MaxScale, HAProxy, Keepalived, Pacemaker / Corosync или аналогичными решениями;
- Опыт проведения регламентных работ с минимальным downtime;
- Опыт аудита продуктивных инсталляций у заказчиков.
Что важно в кандидате:
- Инженерная аккуратность и понимание рисков production-среды;
- Умение сначала проверять гипотезы на стенде, а не сразу применять изменения в production;
- Способность разбираться в сложных инцидентах на стыке приложения, БД, Linux, сети и дисковой подсистемы;
- Клиентоориентированность и зрелая коммуникация;
- Дисциплина: приходить на встречи вовремя, готовиться к ним, выполнять договорённости и заранее предупреждать о рисках;
- Способность лидировать технические встречи, фиксировать решения и следующие шаги;
- Готовность документировать решения и передавать знания команде.
Условия:
- Постоянная занятость;
- Работа с продуктивной, тестовой и лабораторной инфраструктурой;
- Взаимодействие с командой эксплуатации, инженерами SIEM, разработчиками, архитекторами и техническими представителями заказчика;
- Участие в планировании изменений, разборе инцидентов и развитии архитектуры хранения данных.
Специализация
Информационные технологии
DevOps
ClickHouse
MariaDB
Отрасль и сфера применения
SaaS/PaaS
Уровень должности
Сеньор
Тимлид/Руководитель группы
Откликнуться на вакансию
Быстрый отклик и регистрация/авторизацияИли быстрая регистрация/авторизация через OAuth
* Продолжая регистрацию/авторизацию вы подтверждаете свое согласие на хранение и обработку своих персональных данныхв соответствии с Федеральным законом № 152-ФЗ "О персональных данных", а так же подтверждаете, что прочитали и принимаете Пользовательское соглашение и согласие на обработку персональных данных, Условия использования сайта, Политику Конфиденциальности иРазъяснение использования личных данных,и согласны получать информацию и рассылкиот Geekjob через телекомуникационные средства личной связи.
Вакансии от"Umbrella.moscow"
Еще интересные вакансии
Барселона
5K - 7K $
Руководитель продукта / Product Lead
Betting Software
remote
9 сентября
Москва
от 100K ₽
Специалист технической поддержки 1С
МАГ
office
9 сентября
Москва
150K ₽
Аналитик 1С
МАГ
office
9 сентября
Пенза, Ставрополь, Омск, Чебоксары, Волгоград, Барнаул, Таганрог
100K ₽
AI Content Producer / Сценарист обучающих и маркетинговых видео
Университет РАУ
remote
9 сентября
30K ₽
Наставник на курс 1С-аналитик
Яндекс Практикум
remote
8 сентября
Санкт-Петербург
150K - 300K ₽
Менеджер по активным B2B-продажам AI-решений
JTF Технологии
relocateremoteparttime
8 сентября
HU
Business Development Manager (BDM) / Менеджер по развитию бизнеса
HuntRiot (агентство)
remote
8 сентября
Дубай
Маркетолог-стратег по внешнему продвижению (Outreach PR Lead)
ALTWeb Group
remote
8 сентября
Junior DevOps Engineer
Emerging Travel Group
remote
7 сентября
110K ₽
UX/UI-дизайнер / Продуктовый дизайнер
Insaim
remote
7 сентября
Еще...
Эбаут
Ви ар зе дрим тим оф крэзи спешиалистс энд рекрутерс.Ви лов программерс энд ви олвэйс хелп ту файнд зе дрим ворк фор гуд пипл.
Доказательный рекрутинг
NEWHR Medium Blog
Исследования рынка труда
Дайджесты вакансий
Статьи о карьере в IT
NewHR Podcast
Блог нашего FullStack CTO
Контакты
Обратная связь
Условия использования
Конфиденциальность
Услуги и цены
Партнеры
Сейчас на сайте 28482 кандидатов и более 10000 компаний.В среднем 16 откликов на вакансию
Ⓒ Geekjob
Мы используем куки, потому что без кук наш сайт не работал бы, другие сайты не работали бы, да и вообще весьинтернет не работал бы
window.Vacancy = {"id":"6aa157feab97203a790c04e1","ci":"6aa155b6769374ae24030eeb","ic":"6aa15550e04015b7bd050d66","lang":"ru","position":"DevOps / SRE-инженер с экспертизой ClickHouse и MariaDB

