{"id":2008079,"url":"https://alion.io/job/objectware-data-engineer-sparkawsiceberg","title":"Data Engineer Spark/AWS/Iceberg","company":{"id":172908,"name":"Objectware","domain":"objectware.fr","url":"https://alion.io/company/objectware","size_band":"201-500","is_staffing_agency":false,"employer_type":"direct","is_intermediary":false,"listed_via":null,"ats_vendor":null,"truth_index":null},"role":"Data Science","role_family":"Data Science","seniority":null,"employment_type":"freelance","work_mode":"hybrid","remote_scope":null,"remote_scope_basis":null,"remote_working_hours":null,"hiring_geo_confidence":"structured","locations":["France"],"countries":["FR"],"hiring_countries":[],"hiring_countries_total":0,"salary":{"min":40000,"max":76000,"currency":"EUR","period":"year","gross":null,"usd_annual":85520},"salary_estimate":null,"experience_years_min":null,"visa_sponsorship":false,"relocation_package":false,"has_equity":false,"technologies":[{"name":"Agile","optional":false},{"name":"Amazon S3","optional":false},{"name":"Apache Iceberg","optional":false},{"name":"AWS","optional":false},{"name":"CI/CD","optional":false},{"name":"Git","optional":false},{"name":"Python","optional":false},{"name":"Scala","optional":false},{"name":"Scrum","optional":false},{"name":"Spark","optional":false},{"name":"SQL","optional":false}],"status":"live","first_seen_at":"2026-09-28T09:12:36Z","employer_posted_date":null,"last_verified_at":"2026-09-28T09:12:36Z","board_verified":false,"closed_at":null,"days_open":13,"trust":{"level":"not_scored","repost_count":null,"flags":[],"days_open":13},"description":"Nous recherchons un Data Engineer pour rejoindre une équipe dédiée à la construction et à l’évolution d’une plateforme Data alimentant des produits et services à forte volumétrie.\nAu sein d’une équipe pluridisciplinaire composée de Data Engineers, développeurs, DevOps, Scrum Masters et Product Owners, vous évoluerez dans un environnement Agile / Scrum.\nVos missionsConcevoir, développer et maintenir des pipelines de traitement de données avec Apache Spark.\n\nModéliser et faire évoluer des tables Apache Iceberg sur Amazon S3, en garantissant performance, évolutivité et gouvernance.\n\nFiabiliser et industrialiser les flux de données afin de garantir leur fraîcheur, cohérence et disponibilité.\n\nMettre en place des contrôles de qualité des données : complétude, unicité, fraîcheur, cohérence et traçabilité.\n\nDévelopper des traitements robustes et résilients : rejouabilité, gestion des erreurs, retries, backfill et gestion des données en retard.\n\nMettre en place le monitoring et l'observabilité des pipelines : métriques, logs, dashboards et alertes.\n\nParticiper aux phases de tests : tests unitaires, intégration, qualité des données, performance et montée en charge.\n\nDocumenter les pipelines, modèles de données, procédures d’exploitation et choix techniques.\n\nParticiper aux pratiques de CI/CD et aux revues de code.\n\nEnvironnement techniqueApache Spark – Apache Iceberg – AWS – Amazon S3 – Python et/ou Scala – SQL – Git – CI/CD – Monitoring & Alerting\nProfil recherchéFormation supérieure en informatique, Data ou ingénierie.\n\nPremière expérience en Data Engineering.\n\nBonne maîtrise de Spark et SQL.\n\nExpérience en Python ou Scala appréciée.\n\nBonne connaissance des architectures Data sur AWS, notamment S3.\n\nConnaissance d’Iceberg ou de technologies de tables/stockage analytiques similaires.\n\nSensibilité aux enjeux de qualité des données, résilience et observabilité.\n\nAutonomie, curiosité, esprit d’équipe et intérêt pour les environnements techniques modernes.\n\nProfil recherché\nNous recherchons un Data Engineer pour rejoindre une équipe dédiée à la construction et à l’évolution d’une plateforme Data alimentant des produits et services à forte volumétrie.\nAu sein d’une équipe pluridisciplinaire composée de Data Engineers, développeurs, DevOps, Scrum Masters et Product Owners, vous évoluerez dans un environnement Agile / Scrum.\nVos missionsConcevoir, développer et maintenir des pipelines de traitement de données avec Apache Spark.\n\nModéliser et faire évoluer des tables Apache Iceberg sur Amazon S3, en garantissant performance, évolutivité et gouvernance.\n\nFiabiliser et industrialiser les flux de données afin de garantir leur fraîcheur, cohérence et disponibilité.\n\nMettre en place des contrôles de qualité des données : complétude, unicité, fraîcheur, cohérence et traçabilité.\n\nDévelopper des traitements robustes et résilients : rejouabilité, gestion des erreurs, retries, backfill et gestion des données en retard.\n\nMettre en place le monitoring et l'observabilité des pipelines : métriques, logs, dashboards et alertes.\n\nParticiper aux phases de tests : tests unitaires, intégration, qualité des données, performance et montée en charge.\n\nDocumenter les pipelines, modèles de données, procédures d’exploitation et choix techniques.\n\nParticiper aux pratiques de CI/CD et aux revues de code.\n\nEnvironnement techniqueApache Spark – Apache Iceberg – AWS – Amazon S3 – Python et/ou Scala – SQL – Git – CI/CD – Monitoring & Alerting\nProfil recherchéFormation supérieure en informatique, Data ou ingénierie.\n\nPremière expérience en Data Engineering.\n\nBonne maîtrise de Spark et SQL.\n\nExpérience en Python ou Scala appréciée.\n\nBonne connaissance des architectures Data sur AWS, notamment S3.\n\nConnaissance d’Iceberg ou de technologies de tables/stockage analytiques similaires.\n\nSensibilité aux enjeux de qualité des données, résilience et observabilité.\n\nAutonomie, curiosité, esprit d’équipe et intérêt pour les environnements techniques modernes.","description_format":"text","description_chars":3975,"description_truncated":false,"requirements":{"experience_years_min":null,"management_years_min":null,"team_size_min":null,"manages_managers":false,"education":null,"security_clearance":false,"languages":[]},"benefits":[],"hiring_locations":[],"hiring_excludes":[],"relocation_offered":false,"industries":["IT Consulting & Digital Transformation","Custom Software Development","Data Engineering & Migration Services"],"lifecycle":[{"event":"open","at":"2026-10-07T12:33:56Z"}],"visa":[],"liveness":{"score":76,"band":"hot","label":"Hiring now","p_open":1,"p_active":0.841,"p_room":0.9,"age_days":11,"expected_fill_days":29,"reasons":["seen:11","velocity","win:mid"],"computed_at":"2026-10-10T05:45:15Z"},"pay":{"stated_usd_annual":85520,"is_top_pay":false},"html_url":"https://alion.io/job/objectware-data-engineer-sparkawsiceberg","json_url":"https://alion.io/job/objectware-data-engineer-sparkawsiceberg.json","meta":{"generated_at":"2026-10-11T23:25:23Z","cache_seconds":300,"methodology":"https://alion.io/methodology","terms":"https://alion.io/terms","contact":"https://alion.io/contact","api":"https://alion.io/developers","about":"Alion is a live layer of people, companies and AI agents: who they are, whether they are real and active right now, what they do and how to work with them, readable by people and by agents and paid per call.","catalog":"https://alion.io/catalog.json","usage":{"tier":"crawler_verified","counted_by":"address","units_charged":1,"used_today":14361,"day_limit":null,"remaining_today":null,"minute_limit":300,"resets_at":"2026-10-12T00:00:00Z"}},"offers":[{"id":"company.slices","title":"One company in depth, by slice","status":"live","price":{"credits":0.02,"usd":0.002,"plus_per_slice":{"credits":0.05,"usd":0.005}},"unit":"per company, plus each slice with data","note":"the employer in depth","call":{"mcp_tool":"get_company","arguments":{"id":172908},"rest":"https://alion.io/mcp/rest/get_company?id=172908"},"human":"https://alion.io/catalog?offer=company.slices&for=job%2Fobjectware-data-engineer-sparkawsiceberg"},{"id":"market.stats","title":"A market slice: pay, demand and time to fill","status":"live","price":{"credits":1,"usd":0.1},"unit":"per slice","note":"pay, demand and time to fill for this role and place","call":{"mcp_tool":"market_stats"},"human":"https://alion.io/catalog?offer=market.stats&for=job%2Fobjectware-data-engineer-sparkawsiceberg"},{"id":"job.search","title":"Open jobs by role, technology, place, pay and visa","status":"live","price":{"credits":0.02,"usd":0.002},"unit":"per posting in a list","note":"similar open postings","call":{"mcp_tool":"search_jobs"},"human":"https://alion.io/catalog?offer=job.search&for=job%2Fobjectware-data-engineer-sparkawsiceberg"},{"id":"company.verify","title":"Is this company real and active right now","status":"pilot","price":null,"unit":"per company","request":{"url":"https://alion.io/catalog/request","method":"POST","body":"{\"offer\": \"company.verify\", \"for\": \"job/objectware-data-engineer-sparkawsiceberg\", \"note\": \"what you need it for\"}"},"human":"https://alion.io/catalog?offer=company.verify&for=job%2Fobjectware-data-engineer-sparkawsiceberg"}]}