About this role
Taux journalier (TJM): 540€/jour CONTEXTE L'équipe (1 Product Manager, 3 Data Engineer, 1 Data Quality Manager) est au centre de cette dynamique. Son rôle est capital : garantir l'accessibilité, la fiabilité et la qualité des données au service des différentes équipes qui ont des besoins relatifs aux données de pricing. MISSIONS En tant que Data Engineer au sein de cette équipe, vous êtes une personne engagée, dynamique et proactive avec une forte appétence Business. Vous ne vous contentez pas de maintenir des pipelines, vous les concevez pour générer de la valeur et accélérer l'innovation sur notre écosystème. Vous jouerez un rôle pivot dans le succès des nouveaux projets d'intégration d'outils et l'évolution de nos systèmes. Votre mission repose sur les objectifs / responsabilités suivantes : * Concevoir, construire et maintenir des infrastructures et des pipelines robustes et performantes * Garantir une architecture et une modélisation des flux optimisés et évolutives * Garantir la qualité du code et promouvoir les meilleures pratiques * Garantir la clarté et la pérennité des développements par une documentation rigoureuse * Apporter une expertise et aider l'équipe à prendre les meilleurs choix techniques * Transformer la stack legacy vers les nouveaux standards * Garantir un RUN de qualité (SLA) * Assurer la qualité, la fiabilité et la gouvernance des données de pricing * Collaborer en environnement Agile (Scrum) * Respecter les engagements de sprint et s'inscrire dans une démarche d'amélioration continue OUTILS & ENVIRONNEMENT * Plateforme Data Core (Cloud & Gouvernance) Expérience significative sur DataBricks pour la gestion des clusters, l'optimisation des performances des workloads Big Data et la mise en place d'une gouvernance solide Une connaissance de AWS sera un plus * Langages & Modélisation Maîtrise avancée et pratique SQL pour la modélisation, l'optimisation des traitements Expérience significative avec DBT (Data Build Tool) pour l'industrialisation, la documentation et le testing de nos modèles de données Maîtrise avancée et pratique de Python/PySpark pour la transformation et le traitement de données Une expérience sur Spark Scala serait un plus * Orchestration Expérience significative avec Astro / Airflow pour la création, le monitoring et l'optimisation des DAGs (Directed Acyclic Graphs) complexes garantissant la fiabilité de notre chaîne de production Data * Méthodologie & Qualité Travail en environnement agile (Scrum) Pratique quotidienne de la revue de code (code review) et des principes de CI/CD (intégration et déploiement continus) via des outils comme Git/GitLab/GitHub Garantir la qualité de la donnée qui est mise à disposition de nos consommateurs * Modélisation Garantir une modélisation au service du "Easy to Use" et la performance d'utilisation * Communication locale et internationale Assurer une collaboration efficace et de qualité avec nos équipes techniques (Infra, OPS) Une bonne connaissance de l'anglais est demandée notamment à l'écrit pour interagir au quotidien avec nos consommateurs en pays et nos partenaires non francophones CONDITIONS DE TRAVAIL * Localisation : Lille * TJM : 540€ 1. Personne engagée, dynamique et proactive avec une forte appétence Business 2. Expérience significative sur DataBricks pour la gestion des clusters et l'optimisation des performances Big Data 3. Connaissance de AWS (un plus) 4. Maîtrise avancée et pratique de SQL pour la modélisation et l'optimisation des traitements 5. Expérience significative avec DBT (Data Build Tool) pour l'industrialisation, la documentation et le testing des modèles de données 6. Maîtrise avancée et pratique de Python/PySpark pour la transformation et le traitement de données 7. Expérience sur Spark Scala (un plus) 8. Expérience significative