W ITLT pomagamy naszym zaprzyjaźnionym firmom przekształcać ambitne pomysły w cyfrową rzeczywistość. Z nastawieniem na wyzwania, ciekawość technologii i zwinność współtworzymy wyjątkowe rozwiązania IT i zapewniamy doświadczone osoby eksperckie, które pomagają przyspieszać cyfrową transformację.
Aktualnie poszukujemy profilu na stanowisko: Lead Data Architect
Informacje organizacyjne:
Forma współpracy: Kontrakt B2B.
Budżet: 200-280 zł / h na FV, zależnie od doświadczenia i kompetencji.
Tryb pracy: hybrydowo - preferowana obecność w biurze w Warszawie ok. 1 dzień w tygodniu. Dla bardzo doświadczonych osób spoza Warszawy możliwe rzadsze wizyty.
Wymiar pracy: full-time, współpraca długoterminowa.
Sektor: Automotive.
Podróże: sporadyczne, głównie Europa.
Projekt: budowa od podstaw i rozwój nowoczesnej platformy danych dla globalnej organizacji z branży automotive. Głównym obszarem będzie projektowanie i rozwój architektury Data Lakehouse / Data Warehouse w środowisku GCP i Databricks.
Zakres odpowiedzialności:
Projektowanie i rozwój architektury Data Lakehouse / Data Warehouse w środowisku GCP i Databricks.
Projektowanie, rozwój i optymalizacja pipeline'ów danych z wykorzystaniem Spark, PySpark, Python i SQL.
Projektowanie modeli danych oraz standardów Data Governance, bezpieczeństwa i Data Lineage.
Optymalizacja wydajności i kosztów przetwarzania danych oraz istniejących rozwiązań.
Współpraca z Data Engineerami, analitykami i zespołami biznesowymi przy przekładaniu potrzeb na rozwiązania techniczne.
Rozwój procesów CI/CD oraz współpraca z zespołami DevOps i Security.
Projektowanie fundamentów danych wspierających AI, RAG i rozwiązania oparte o LLM.
Rekomendowanie usprawnień technologicznych oraz wyznaczanie dobrych praktyk w obszarze Data Architecture.
Technologie na projekcie:
BigQuery, Cloud Storage, Pub/Sub
Databricks, Delta Lake, Apache Spark, Databricks SQL
Python, PySpark, SQL
Unity Catalog
DGitLab, Jenkins, Terraform
Vector Search, RAG, Vertex AI
Power BI, Looker Studio
Oczekiwania:
Minimum 10 lat doświadczenia w Data Engineering, Data Architecture lub podobnym obszarze.
Bardzo dobre doświadczenie z Databricks i Apache Spark, najlepiej w środowisku GCP.
Praktyczna znajomość GCP, w szczególności BigQuery i Cloud Storage.
Bardzo dobra znajomość Python / PySpark oraz zaawansowanego SQL.
Doświadczenie w projektowaniu i optymalizacji pipeline'ów danych na dużą skalę.
Znajomość architektury Data Warehouse / Data Lake / Lakehouse oraz Delta Lake.
Doświadczenie w projektowaniu mechanizmów Data Governance, bezpieczeństwa i kontroli dostępu.
Umiejętność analizy istniejących rozwiązań i projektowania ich bardziej wydajnych oraz skalowalnych odpowiedników.
Doświadczenie w pracy z zespołami Data Engineering oraz osobami nietechnicznymi.
Umiejętność podejmowania decyzji architektonicznych i przekładania ich na konkretne rozwiązania techniczne.
Bardzo dobra znajomość języka angielskiego.
Mile widziane:
Certyfikacja Databricks Data Engineer lub Google Cloud Professional Data Engineer.
Doświadczenie z Kafka, Pub/Sub, Airflow / Cloud Composer.
Znajomość dbt / Dataform.
Terraform oraz CI/CD.
Doświadczenie z Power BI lub Looker.
Praktyczna znajomość RAG, Vector Databases, embeddings lub integracji LLM z platformami danych.
Doświadczenie w projektach wykorzystujących AI/ML.
Oferujemy:
Długofalową współpracę B2B z IT LeasingTeam.
Pracę przy budowie greenfieldowej platformy danych w globalnej organizacji automotive.
Duży wpływ na decyzje architektoniczne i standardy technologiczne.
Elastyczny model hybrydowy z możliwością ustalenia rzadszych wizyt w Warszawie dla osób spoza miasta.
Dostęp do benefitów: MultiSport, PZU, LuxMed.
Bezpośredni kontakt z rekruterem ITLT i przejrzysty proces rekrutacyjny.

