{"id":816272,"url":"https://alion.io/job/geci-database-engineer-elasticsearch-opensearch-apache-iceberg","title":"Database Engineer – ElasticSearch / OpenSearch & Apache Iceberg","company":{"id":691382,"name":"Geci","domain":"geci.net","url":"https://alion.io/company/geci","size_band":null,"is_staffing_agency":false,"employer_type":"direct","is_intermediary":false,"listed_via":null,"ats_vendor":"Teamtailor","truth_index":{"grade":"D","score":53,"open_postings":18,"ghost_share":0.778,"stale_share":0,"repost_share":0,"time_to_fill_p50_days":null,"computed_at":"2026-09-29T05:45:00Z"}},"role":"Data Science","role_family":"Data Science","seniority":null,"employment_type":"full_time","work_mode":"on_site","remote_scope":null,"remote_scope_basis":null,"remote_working_hours":null,"hiring_geo_confidence":"inferred","locations":[],"countries":[],"hiring_countries":[],"hiring_countries_total":0,"salary":null,"salary_estimate":null,"experience_years_min":null,"visa_sponsorship":false,"relocation_package":false,"has_equity":false,"technologies":[{"name":"Amazon S3","optional":false},{"name":"Ansible","optional":false},{"name":"Apache Hudi","optional":false},{"name":"Apache Iceberg","optional":false},{"name":"CI/CD","optional":false},{"name":"Delta Lake","optional":false},{"name":"Docker","optional":false},{"name":"ElasticSearch","optional":false},{"name":"Flink","optional":false},{"name":"Grafana","optional":false},{"name":"Helm","optional":false},{"name":"Kibana","optional":false},{"name":"Kubernetes","optional":false},{"name":"Linux","optional":false},{"name":"MinIO","optional":false},{"name":"OpenSearch","optional":false},{"name":"Prometheus","optional":false},{"name":"Spark","optional":false},{"name":"Trino","optional":false}],"status":"live","first_seen_at":"2026-05-07T14:55:10Z","employer_posted_date":"2026-05-07","last_verified_at":"2026-09-26T19:22:08Z","board_verified":false,"closed_at":null,"days_open":145,"trust":{"level":"ghost","repost_count":0,"flags":["stale","company_stale"],"days_open":144},"description":"Contexte du poste\nAlliance Services Plus (AS+) recherche un(e) Ingénieur(e) Base de Données - Search & Data Platform pour le compte de l’un de ses clients du secteur audiovisuel.\nDans le cadre de la modernisation de sa plateforme de recherche et de gestion de données, le client engage une refonte de son architecture autour de principes cloud-native : clusters de recherche conteneurisés, stockage objet et formats ouverts de data lake.\nVous intégrerez une équipe technique en charge de travaux de preuve de concept et d’intégration amont, avec pour objectif de définir les fondations techniques de la future plateforme et de produire des livrables directement exploitables en phase de construction.\nMissions principales\nDans un cadre d’ingénierie et d’expérimentation technique, les missions pourront inclure :\nLa conception, le déploiement et l’exploitation de clusters ElasticSearch / OpenSearch en environnement de preuve de concept\n\nL’intégration de ces plateformes sur Kubernetes, via opérateurs ou déploiements Helm\n\nLa définition des topologies de clusters, des stratégies de réplication, de partitionnement et de cycle de vie des index\n\nLa réalisation de tests de charge, de benchmarks de performance et de recommandations de tuning\n\nLa définition de procédures de sauvegarde, restauration et reprise d’activité via stockage objet compatible S3\n\nLa conduite d’un proof of concept autour d’ Apache Iceberg comme format de table pour data lake\n\nL’évaluation des solutions de catalogue, des moteurs de requête et des stratégies de partitionnement et d’évolution de schéma\n\nL’automatisation du provisioning des composants d’infrastructure et de la chaîne de déploiement\n\nLa mise en place de solutions d’observabilité (métriques, logs, tableaux de bord)\n\nLa rédaction de documentation technique, comptes-rendus d’expérimentation et transfert de connaissances auprès des équipes projet\n\nEnvironnement technique\nLes projets s’appuient principalement sur les technologies suivantes :\nMoteurs de recherche : ElasticSearch, OpenSearch\n\nData lake : Apache Iceberg\n\nOrchestration & conteneurs : Docker, Kubernetes, Helm, opérateurs\n\nAutomatisation : Ansible\n\nStockage objet : S3 et solutions compatibles (MinIO, Ceph, etc.)\n\nObservabilité : Prometheus, Grafana, Kibana / OpenSearch Dashboards\n\nMoteurs de requête (selon périmètre) : Trino, Spark, Flink\n\nSystèmes : Linux, scripting shell, fondamentaux réseau\n\nProfil recherché\nExpérience confirmée en exploitation de clusters ElasticSearch ou OpenSearch en environnement de production ou assimilé\n\nBonne connaissance d’Apache Iceberg, de son modèle de catalogues et de son intégration avec des moteurs analytiques\n\nMaîtrise d’Ansible pour l’automatisation d’infrastructure et des déploiements\n\nExpérience de déploiement et d’exploitation de workloads stateful sur Kubernetes\n\nBonne compréhension des architectures cloud-native, du stockage objet et des problématiques de performance\n\nQualités attendues :\nCuriosité technique et autonomie\n\nCapacité d’analyse et esprit pragmatique\n\nAisance rédactionnelle et capacité de formalisation\n\nCapacité à travailler en équipe dans des environnements multi-interlocuteurs\n\nAtouts appréciés :\nConnaissance des environnements data lake (Delta Lake, Hudi)\n\nExpérience avec des moteurs analytiques modernes (Trino, Spark, Flink, Dremio)\n\nExpérience CI/CD appliquée à l’infrastructure\n\nConnaissance du secteur audiovisuel, média ou environnements réglementés\n\nInformations complémentaires\nLocalisation : Bry-sur-Marne (Île-de-France), 2 jours/semaine sur site\n\nLangues : français courant, anglais technique","description_format":"text","description_chars":3588,"description_truncated":false,"requirements":{"experience_years_min":null,"management_years_min":null,"team_size_min":null,"manages_managers":false,"education":null,"security_clearance":false,"languages":[{"language":"French","level":"Advanced (C1)","optional":false}]},"benefits":[],"hiring_locations":[],"hiring_excludes":[],"relocation_offered":false,"industries":["Smart Building & Cities","Smart City"],"lifecycle":[{"event":"open","at":"2026-09-12T11:21:25Z"}],"liveness":{"score":3,"band":"cold","label":"Long shot","p_open":0.9,"p_active":0.124,"p_room":0.28,"age_days":144,"expected_fill_days":21,"reasons":["conf:58","stale_co","ghost","win:tail","crowd:"],"computed_at":"2026-09-29T05:45:00Z"},"pay":null,"html_url":"https://alion.io/job/geci-database-engineer-elasticsearch-opensearch-apache-iceberg","json_url":"https://alion.io/job/geci-database-engineer-elasticsearch-opensearch-apache-iceberg.json","meta":{"generated_at":"2026-09-30T02:26:22Z","cache_seconds":300,"methodology":"https://alion.io/methodology","terms":"https://alion.io/terms","contact":"https://alion.io/contact","api":"https://alion.io/developers","usage":{"tier":"crawler","counted_by":"address","units_charged":1,"used_today":1655,"day_limit":5000,"remaining_today":3345,"minute_limit":60,"resets_at":"2026-10-01T00:00:00Z"}}}