Senior Data Engineer avec plus de 7 ans d'expérience dans des environnements Big Data et Cloud. Expertise dans la conception et optimisation de pipelines de données et solutions data scalables chez des acteurs majeurs comme INA, OppScience, Mutex et Harmonie Mutuelle. Maîtrise des technologies Spark, Python, Java, Cloud (AWS, Azure, GCP) et outils CI/CD. Expérience en coaching d'équipes et collaboration avec des architectes pour intégrer des solutions dans des SI complexes.
Conception et mise en œuvre d'une plateforme data basée sur une architecture Médaillon (Bronze, Argent, Or) dans un contexte cloud AWS. Direction d'une équipe de 6 à 8 membres. Développement de pipelines de données avec Spark, automatisation avec Step Functions, développement d'API REST avec SpringBoot, création de tableaux de bord PowerBI, mise en place de pipelines CI/CD avec Jenkins et Terraform.
Conception et mise en œuvre de solutions de traitement et analyse de données massives avec PySpark dans Azure, intégration dans Elasticsearch pour des fonctionnalités de recherche avancée. Développement de composants PQL, optimisation des recherches Elasticsearch, création de tableaux de bord Kibana, automatisation des workflows avec Jenkins.
Conception d'un moteur de recherche plein texte pour l'indexation et visualisation de contenus multimédias. Utilisation de Talend et GCP Dataflow pour le traitement des données, développement avec Elasticsearch et Kibana, création de rapports PowerBI, orchestration avec Cloud Composer, automatisation des déploiements avec Jenkins.