433,171open jobs
15,047companies
61,203added this week
Browse all
Salary
$60k – $84k per year
Location
In office (Stavropol)
Employment
Full-Time
Overview
Company
Impact
Profile match

Привет! Меня зовут Эля, я HR компании «Амбрелла».

Мы - аккредитованная IT-компания в сфере информационной безопасности. Развиваем высоконагруженную SIEM-платформу для сбора, хранения и обработки событий ИБ.

Сейчас ищем DevOps / SRE-инженера уровня Middle+/Senior с глубокой практической экспертизой по ClickHouse и уверенным опытом эксплуатации MariaDB.

Основной фокус роли - промышленная эксплуатация ClickHouse: кластеры, репликация, шардирование, производительность, хранение больших объёмов данных, backup/restore, мониторинг, безопасность и безопасное проведение изменений в production.

Вторая важная зона -

MariaDB: эксплуатация, репликация, отказоустойчивость, Galera Cluster, backup/restore, disaster recovery, performance tuning и миграция с master-master-репликации на более надёжную кластерную архитектуру.

Нам нужен инженер, который умеет не просто «поднять базу», а безопасно эксплуатировать production-инфраструктуру с критически важными данными: проверять гипотезы на стендах, оценивать риски, готовить rollback-план, участвовать в расследовании инцидентов и фиксировать результаты в документации.

Чем предстоит заниматься:

ClickHouse:

- Администрировать продуктивные и тестовые кластеры ClickHouse;

- Контролировать состояние шардов, реплик, Distributed-таблиц и ReplicatedMergeTree-таблиц;

- Диагностировать replication queue, merges, mutations, inserts, деградацию запросов и проблемы с дисковой подсистемой;

- Анализировать системные таблицы ClickHouse и состояние кластера;

- Участвовать в изменении топологии кластера: добавление шардов, реплик, серверов, изменение Distributed-таблиц;

- Планировать горизонтальное масштабирование ClickHouse-кластера;

- Оптимизировать схемы данных, партиционирование, ключи сортировки, TTL, индексы, storage policy и настройки сервера;

- Работать с хранением данных: локальные диски, LUN, DAS, hot / warm storage, S3-совместимое хранилище;

- Прорабатывать дедупликацию данных, повышение уровня сжатия и механизм токенизации / full text search по событиям;

- Настраивать и сопровождать ClickHouse Keeper / ZooKeeper;

- Настраивать TLS/SSL для клиентских подключений и межсерверного взаимодействия;

- Разрабатывать и проверять backup/restore и disaster recovery;

- Настраивать мониторинг, алерты и дашборды по ClickHouse;

- Готовить Ansible playbooks / roles, runbook’и, инструкции, чек-листы и технические отчёты.

MariaDB:

- Администрировать продуктивные и тестовые инсталляции MariaDB;

- контролировать состояние серверов, репликации, соединений, транзакций, блокировок и фоновых процессов;

- Настраивать и сопровождать репликацию: master-slave, master-master, GTID-based replication;

- Диагностировать replication lag, ошибки SQL thread / IO thread, рассинхронизацию данных и конфликты при master-master-схемах;

- Участвовать в миграции MariaDB с master-master-репликации на Galera Cluster;

- Настраивать, сопровождать и диагностировать Galera Cluster;

- Прорабатывать HA-архитектуру MariaDB: failover, fencing, VIP / proxy layer, split-brain-риски;

- Разрабатывать и проверять disaster recovery-сценарии, RPO / RTO и восстановимость резервных копий;

- Анализировать производительность: slow queries, EXPLAIN, индексы, locks, deadlocks, buffer pool, connection pool, disk IO;

- Оптимизировать конфигурацию MariaDB с учётом нагрузки, объёма данных, RAM, CPU, дисковой подсистемы и сети;

- Настраивать TLS/SSL для клиентских подключений и репликации;

- Настраивать мониторинг, алерты, дашборды и runbook’и по MariaDB.

Production, автоматизация и взаимодействие:

- Участвовать в расследовании production-инцидентов, связанных с ClickHouse, MariaDB, Linux, сетью или дисковой подсистемой;

- Анализировать метрики, логи, системные таблицы, состояние репликации, блокировки, диски, сеть и конфигурации;

- Формулировать технические гипотезы, проверять их и отделять пер"}

menu

UM

DevOps / SRE-инженер с экспертизой ClickHouse и MariaDB

Прямой работодатель Umbrella.moscow( umbrella.moscow )

Сеньор

  • Тимлид/Руководитель группы

Информационные технологии

  • DevOps
  • ClickHouse
  • MariaDB
  • SaaS/PaaS

9 сентября

Опыт работы любой

Работодатель Umbrella.moscow

Короткая ссылка: geekjob.ru/hihh

Откликнуться

Описание вакансии

Привет! Меня зовут Эля, я HR компании «Амбрелла».

Мы - аккредитованная IT-компания в сфере информационной безопасности. Развиваем высоконагруженную SIEM-платформу для сбора, хранения и обработки событий ИБ.

Сейчас ищем DevOps / SRE-инженера уровня Middle+/Senior с глубокой практической экспертизой по ClickHouse и уверенным опытом эксплуатации MariaDB.

Основной фокус роли - промышленная эксплуатация ClickHouse: кластеры, репликация, шардирование, производительность, хранение больших объёмов данных, backup/restore, мониторинг, безопасность и безопасное проведение изменений в production.

Вторая важная зона -

MariaDB: эксплуатация, репликация, отказоустойчивость, Galera Cluster, backup/restore, disaster recovery, performance tuning и миграция с master-master-репликации на более надёжную кластерную архитектуру.

Нам нужен инженер, который умеет не просто «поднять базу», а безопасно эксплуатировать production-инфраструктуру с критически важными данными: проверять гипотезы на стендах, оценивать риски, готовить rollback-план, участвовать в расследовании инцидентов и фиксировать результаты в документации.

Чем предстоит заниматься:

ClickHouse:

- Администрировать продуктивные и тестовые кластеры ClickHouse;

- Контролировать состояние шардов, реплик, Distributed-таблиц и ReplicatedMergeTree-таблиц;

- Диагностировать replication queue, merges, mutations, inserts, деградацию запросов и проблемы с дисковой подсистемой;

- Анализировать системные таблицы ClickHouse и состояние кластера;

- Участвовать в изменении топологии кластера: добавление шардов, реплик, серверов, изменение Distributed-таблиц;

- Планировать горизонтальное масштабирование ClickHouse-кластера;

- Оптимизировать схемы данных, партиционирование, ключи сортировки, TTL, индексы, storage policy и настройки сервера;

- Работать с хранением данных: локальные диски, LUN, DAS, hot / warm storage, S3-совместимое хранилище;

- Прорабатывать дедупликацию данных, повышение уровня сжатия и механизм токенизации / full text search по событиям;

- Настраивать и сопровождать ClickHouse Keeper / ZooKeeper;

- Настраивать TLS/SSL для клиентских подключений и межсерверного взаимодействия;

- Разрабатывать и проверять backup/restore и disaster recovery;

- Настраивать мониторинг, алерты и дашборды по ClickHouse;

- Готовить Ansible playbooks / roles, runbook'и, инструкции, чек-листы и технические отчёты.

MariaDB:

- Администрировать продуктивные и тестовые инсталляции MariaDB;

- контролировать состояние серверов, репликации, соединений, транзакций, блокировок и фоновых процессов;

- Настраивать и сопровождать репликацию: master-slave, master-master, GTID-based replication;

- Диагностировать replication lag, ошибки SQL thread / IO thread, рассинхронизацию данных и конфликты при master-master-схемах;

- Участвовать в миграции MariaDB с master-master-репликации на Galera Cluster;

- Настраивать, сопровождать и диагностировать Galera Cluster;

- Прорабатывать HA-архитектуру MariaDB: failover, fencing, VIP / proxy layer, split-brain-риски;

- Разрабатывать и проверять disaster recovery-сценарии, RPO / RTO и восстановимость резервных копий;

- Анализировать производительность: slow queries, EXPLAIN, индексы, locks, deadlocks, buffer pool, connection pool, disk IO;

- Оптимизировать конфигурацию MariaDB с учётом нагрузки, объёма данных, RAM, CPU, дисковой подсистемы и сети;

- Настраивать TLS/SSL для клиентских подключений и репликации;

- Настраивать мониторинг, алерты, дашборды и runbook'и по MariaDB.

Production, автоматизация и взаимодействие:

- Участвовать в расследовании production-инцидентов, связанных с ClickHouse, MariaDB, Linux, сетью или дисковой подсистемой;

- Анализировать метрики, логи, системные таблицы, состояние репликации, блокировки, диски, сеть и конфигурации;

- Формулировать технические гипотезы, проверять их и отделять первопричину от сопутствующих факторов;

- Готовить технические выводы по итогам инцидентов и участвовать в postmortem-разборах;

- Разворачивать тестовые стенды ClickHouse и MariaDB для проверки архитектурных решений;

- Проверять обновления, изменение топологии, расширение хранилища, storage policy и параметры ClickHouse / MariaDB до применения в production;

- Автоматизировать типовые операции через Ansible / Bash / Python / Terraform или аналогичные инструменты;

- Взаимодействовать с заказчиками, объяснять технические риски понятным языком, предлагать решения и лидировать технические обсуждения.

Обязательные требования:

- Практический опыт промышленной эксплуатации ClickHouse;

- Понимание архитектуры ClickHouse: shards, replicas, Distributed tables, ReplicatedMergeTree, MergeTree family;

- Опыт диагностики replication queue, merges, mutations, insert/select latency, деградации запросов и проблем с дисковой подсистемой;

- Понимание партиционирования, ключей сортировки, TTL, storage policies, disks, volumes, data skipping indexes;

- Опыт изменения топологии ClickHouse-кластера или глубокое понимание порядка и рисков таких изменений;

- Опыт настройки TLS/SSL для ClickHouse;

- Опыт эксплуатации MariaDB в продуктивной или близкой к продуктивной среде;

- Понимание MariaDB, InnoDB, транзакций, индексов, блокировок, deadlocks, isolation levels;

- Опыт настройки и диагностики репликации MariaDB;

- Понимание GTID, binary logs, relay logs, replication lag, failover и рисков master-master-репликации;

- Опыт настройки backup/restore MariaDB и проверки восстановимости резервных копий;

-Опыт диагностики производительности MariaDB: slow query log, EXPLAIN, индексы, locks, buffer pool, disk IO;

- Опыт эксплуатации Linux-серверов;

- Понимание влияния CPU, RAM, disk IO, network и filesystem на работу ClickHouse и MariaDB;

- Опыт настройки мониторинга и алертов для ClickHouse, MariaDB и инфраструктуры;

- Опыт работы с Prometheus, Grafana, Zabbix или аналогичными системами мониторинга;

- Опыт автоматизации через Ansible, Bash, Python или аналогичные инструменты;

- Умение аккуратно проводить изменения в production: план работ, оценка рисков, rollback-план, проверка результата;

- Умение писать техническую документацию: инструкции, runbook'и, чек-листы, postmortem-отчёты.

Желательные требования:

- Опыт или уверенное понимание Galera Cluster;

- Опыт эксплуатации ClickHouse и MariaDB в составе SIEM, SOC, log management, observability, telemetry или других высоконагруженных систем;

- Опыт работы с большими объёмами данных: десятки или сотни ТБ;

- Опыт работы с ClickHouse Keeper или ZooKeeper;

- Опыт эксплуатации ClickHouse / MariaDB на bare metal;

- Опыт работы с LUN, DAS, локальными дисковыми массивами и S3-совместимыми объектными хранилищами;

- Опыт нагрузочного тестирования ClickHouse и MariaDB;

- Опыт построения процедур disaster recovery;

- Опыт подготовки архитектурных и эксплуатационных документов для заказчиков;

- Опыт работы с ProxySQL, MaxScale, HAProxy, Keepalived, Pacemaker / Corosync или аналогичными решениями;

- Опыт проведения регламентных работ с минимальным downtime;

- Опыт аудита продуктивных инсталляций у заказчиков.

Что важно в кандидате:

- Инженерная аккуратность и понимание рисков production-среды;

- Умение сначала проверять гипотезы на стенде, а не сразу применять изменения в production;

- Способность разбираться в сложных инцидентах на стыке приложения, БД, Linux, сети и дисковой подсистемы;

- Клиентоориентированность и зрелая коммуникация;

- Дисциплина: приходить на встречи вовремя, готовиться к ним, выполнять договорённости и заранее предупреждать о рисках;

- Способность лидировать технические встречи, фиксировать решения и следующие шаги;

- Готовность документировать решения и передавать знания команде.

Условия:

- Постоянная занятость;

- Работа с продуктивной, тестовой и лабораторной инфраструктурой;

- Взаимодействие с командой эксплуатации, инженерами SIEM, разработчиками, архитекторами и техническими представителями заказчика;

- Участие в планировании изменений, разборе инцидентов и развитии архитектуры хранения данных.

Специализация

Информационные технологии

DevOps

ClickHouse

MariaDB

Отрасль и сфера применения

SaaS/PaaS

Уровень должности

Сеньор

Тимлид/Руководитель группы

Откликнуться на вакансию

Быстрый отклик и регистрация/авторизация

Или быстрая регистрация/авторизация через OAuth

* Продолжая регистрацию/авторизацию вы подтверждаете свое согласие на хранение и обработку своих персональных данныхв соответствии с Федеральным законом № 152-ФЗ "О персональных данных", а так же подтверждаете, что прочитали и принимаете Пользовательское соглашение и согласие на обработку персональных данных, Условия использования сайта, Политику Конфиденциальности иРазъяснение использования личных данных,и согласны получать информацию и рассылкиот Geekjob через телекомуникационные средства личной связи.

Вакансии от"Umbrella.moscow"

Еще интересные вакансии

  • Барселона

    5K - 7K $

    Руководитель продукта / Product Lead

    Betting Software

    remote

    9 сентября

  • Москва

    от 100K ₽

    Специалист технической поддержки 1С

    МАГ

    office

    9 сентября

  • Москва

    150K ₽

    Аналитик 1С

    МАГ

    office

    9 сентября

  • Пенза, Ставрополь, Омск, Чебоксары, Волгоград, Барнаул, Таганрог

    100K ₽

    AI Content Producer / Сценарист обучающих и маркетинговых видео

    Университет РАУ

    remote

    9 сентября

  • 30K ₽

    Наставник на курс 1С-аналитик

    Яндекс Практикум

    remote

    8 сентября

  • Санкт-Петербург

    150K - 300K ₽

    Менеджер по активным B2B-продажам AI-решений

    JTF Технологии

    relocateremoteparttime

    8 сентября

  • HU

    Business Development Manager (BDM) / Менеджер по развитию бизнеса

    HuntRiot (агентство)

    remote

    8 сентября

  • Дубай

    Маркетолог-стратег по внешнему продвижению (Outreach PR Lead)

    ALTWeb Group

    remote

    8 сентября

  • Junior DevOps Engineer

    Emerging Travel Group

    remote

    7 сентября

  • 110K ₽

    UX/UI-дизайнер / Продуктовый дизайнер

    Insaim

    remote

    7 сентября

Еще...

Эбаут

Ви ар зе дрим тим оф крэзи спешиалистс энд рекрутерс.Ви лов программерс энд ви олвэйс хелп ту файнд зе дрим ворк фор гуд пипл.

Доказательный рекрутинг

NEWHR Medium Blog

Исследования рынка труда

Дайджесты вакансий

Статьи о карьере в IT

NewHR Podcast

Блог нашего FullStack CTO

Контакты

  • Обратная связь

  • Условия использования

  • Конфиденциальность

  • Услуги и цены

Партнеры

Сейчас на сайте 28482 кандидатов и более 10000 компаний.В среднем 16 откликов на вакансию

Ⓒ Geekjob

Мы используем куки, потому что без кук наш сайт не работал бы, другие сайты не работали бы, да и вообще весьинтернет не работал бы

window.Vacancy = {"id":"6aa157feab97203a790c04e1","ci":"6aa155b6769374ae24030eeb","ic":"6aa15550e04015b7bd050d66","lang":"ru","position":"DevOps / SRE-инженер с экспертизой ClickHouse и MariaDB

Free account
Stop reading job ads. Get the ones that fit.
One free account turns this page into a shortlist built around your stack, your level and your pay.
Match on every job. Stack, seniority, pay and location, scored against your profile.
433,171 open roles. Read straight off company career pages, refreshed every day.
Unlimited applications. Every one you send is tracked in one place, on-site or on a company board.
3 tailored CVs a month. Rewritten for the exact job you are applying to. Included free.
Create a free account
Free forever. No card. Under a minute.

Your match

How well do you fit this role?
Two answers are enough for a real match. No account needed.
Check my fit
Answers stay in this browser until you create an account.

Recommended for you based on this role

Similar stack
Same company
Stavropol
$94k – $125k per year • Remote/Hybrid • Full-Time • 3+ years exp • Bachelor's Degree • New York
Python
SQL
Databases
Snowflake
Databricks
Google BigQuery
BigQuery
Analytics
Power BI
A/B Testing
Apply
Finance Lead 1 day ago
$129k – $244k per year • Equity • In office • Full-Time • Bachelor's Degree • San Jose • Seattle • San Francisco
Python
SQL
Management
Outlook
Apply
$152k – $265k per year • Equity • Remote/Hybrid • Full-Time • 8+ years exp • Bachelor's Degree • San Jose • Austin • Seattle • New York • Chicago
Python
SQL
AI/ML
AI Agents
PyTorch
Anomaly Detection
Human-in-the-Loop
Apply
$114k – $273k per year • Equity • In office • Full-Time • 10+ years exp • Bachelor's Degree • San Jose • New York • Austin
Python
JavaScript
SQL
DevOps
CI/CD
Git
Apply
$139k – $258k per year • Equity • In office • Full-Time • 8+ years exp • Bachelor's Degree • San Jose • New York • Austin
Python
JavaScript
SQL
DevOps
Rest API
CI/CD
Git
Apply
up to $34k per year (net) • In office • Full-Time • Bachelor's Degree • Stavropol
Apply
$18k – $34k per year (net) • In office • Full-Time • Stavropol
Apply
$6.9k – $14k per year (net) • In office • 1+ year exp • Stavropol
Apply
$14k – $19k per year (gross) • In office • Full-Time • Stavropol
Apply
$13k – $32k per year (Estimated) • In office • Full-Time • Stavropol
Apply
See all jobs
This is one of many
433,171 more open roles from verified company boards, updated every day.