{"id":1508967,"url":"https://alion.io/job/lamoda-senior-big-data-engineer-data-platform","title":"Senior Big Data Engineer (Data Platform)","company":{"id":13920,"name":"Lamoda","domain":"lamoda.ru","url":"https://alion.io/company/lamoda","size_band":"201-500","is_staffing_agency":false,"employer_type":"direct","is_intermediary":false,"listed_via":null,"ats_vendor":"HeadHunter","truth_index":null},"role":"Data Science","role_family":"Data Science","seniority":"senior","employment_type":null,"work_mode":"remote","remote_scope":"stated_regions","remote_scope_basis":"board_field","remote_working_hours":null,"hiring_geo_confidence":"structured","locations":["Moscow, Russia"],"countries":["RU"],"hiring_countries":["RU","BY","KZ","KG","AM"],"hiring_countries_total":5,"salary":null,"salary_estimate":{"min_usd":31000,"max_usd":58000,"period":"year","method":"role_seniority_country_cell","sample_n":11},"experience_years_min":null,"visa_sponsorship":false,"relocation_package":false,"has_equity":false,"technologies":[{"name":"Airflow","optional":false},{"name":"Apache Iceberg","optional":false},{"name":"CI/CD","optional":false},{"name":"ETL/ELT","optional":false},{"name":"Git","optional":false},{"name":"Hadoop","optional":false},{"name":"Java","optional":false},{"name":"Kubernetes","optional":false},{"name":"pySpark","optional":false},{"name":"Python","optional":false},{"name":"Scala","optional":false},{"name":"Spark","optional":false},{"name":"SQL","optional":false},{"name":"Trino","optional":false},{"name":"Apache Kafka","optional":true},{"name":"Claude Code","optional":true},{"name":"ClickHouse","optional":true},{"name":"Docker","optional":true},{"name":"LLM","optional":true},{"name":"RAG","optional":true},{"name":"Yandex Cloud","optional":true}],"status":"live","first_seen_at":"2026-09-30T07:01:08Z","employer_posted_date":"2026-09-30","last_verified_at":"2026-10-01T04:06:03Z","board_verified":true,"closed_at":null,"days_open":1,"trust":{"level":"ok","repost_count":null,"flags":[],"days_open":1},"description":"Чем предстоит заниматься:\n Разрабатывать и совершенствовать лучшую на рынке платформу данных электронной коммерции нового поколения;\n Проектировать и разрабатывать ETL пайплайны на Airflow для Spark (Batch, Streaming), Iceberg, Trino;\n Оптимизировать действующие пайплайны и джобы на Spark - мониторить нагрузку на кластер и оптимальность затрачиваемых джобами ресурсов и если необходимо оптимизировать;\n Взаимодействовать с аналитиками и ML специалистами для создания/развертывания инструментов и наборов данных, соответствующих их вариантам использования - поддерживать регулярные связи с data ops для развития дата-платформы;\n Анализировать и внедрять инструменты инжиниринга данных (Lineage, DQ);\n Проектировать хранилища данных на основе k8s, настраивать производительность, мониторинг, планировать емкости кластера и другой инфраструктуры - думать над тем что и как грузить и в каких партициях;\n Решать задачи, связанные с внедрением облачной инфраструктуры - разрабатывать новую архитектуру хранилища\n Проводить code review и принимать участие в архитектурных решениях по дата платформе в команде.\n Мы ожидаем:\n Kubernetes - понимание ресурсной модели, просмотр конфигураций, troubleshooting.\n Опыт работы с Hadoop (HDFS, Hive Metastore)\n Опыт работы со Spark (spark SQL, streaming, понимание ньюансов работы с pyspark);\n Apache Icberg - владение процедурами, snapshots, maintenance\n Глубокое понимание Airflow (2, 3) - идемпотентность, assets, backfills\n Уверенное знание Git, CI/CD;\n Python, Scala/Java - ООП, проектирование библиотек, интеграционные/юнит тесты;\n Хорошее понимание СУБД, SQL;\n Будет плюсом:\n Опыт работы с Docker (уверенное владение для поднятия локального окружения проекта);\n Опыт работы с Kafka - понимание архитектуры и слабых мест;\n Опыт с облачными технологиями: преимущественно Yandex Cloud;\n Опыт с Clickhouse.\n AI-native подход к разработке: активное использование Claude Code / Codex и подобных инструментов, опыт построения harness-систем - агентов с инструментами, автоматизации через LLM, RAG.","description_format":"text","description_chars":2032,"description_truncated":false,"requirements":{"experience_years_min":null,"management_years_min":null,"team_size_min":null,"manages_managers":false,"education":null,"security_clearance":false,"languages":[{"language":"Russian","level":"Advanced (C1)","optional":false}]},"benefits":[],"hiring_locations":[{"name":"Russia","iso":"RU","kind":"country"},{"name":"Belarus","iso":"BY","kind":"region"},{"name":"Kazakhstan","iso":"KZ","kind":"region"},{"name":"Kyrgyzstan","iso":"KG","kind":"region"},{"name":"Armenia","iso":"AM","kind":"region"}],"hiring_excludes":[],"relocation_offered":false,"industries":["Footwear","Marketplaces","Apparel & Fashion Brands"],"lifecycle":[{"event":"open","at":"2026-09-30T07:04:26Z"}],"liveness":{"score":90,"band":"hot","label":"Hiring now","p_open":1,"p_active":0.903,"p_room":1,"age_days":0,"expected_fill_days":5,"reasons":["conf:1","velocity","win:early"],"computed_at":"2026-10-01T05:45:00Z"},"pay":null,"html_url":"https://alion.io/job/lamoda-senior-big-data-engineer-data-platform","json_url":"https://alion.io/job/lamoda-senior-big-data-engineer-data-platform.json","meta":{"generated_at":"2026-10-01T19:35:25Z","cache_seconds":300,"methodology":"https://alion.io/methodology","terms":"https://alion.io/terms","contact":"https://alion.io/contact","api":"https://alion.io/developers","usage":{"tier":"crawler","counted_by":"address","units_charged":1,"used_today":2232,"day_limit":5000,"remaining_today":2768,"minute_limit":60,"resets_at":"2026-10-02T00:00:00Z"}}}