Data engineer spécialisé sur les pipelines à grande échelle : ingestion, transformation et exposition de données pour des cas d'usage analytiques et IA. J'interviens de la modélisation à l'industrialisation, avec une forte culture qualité et gouvernance des données.
Conception d'une plateforme data Snowflake alimentée par Spark et orchestrée par Airflow : 200+ pipelines, 4 To/jour, mise en place du data quality framework.
Construction de pipelines d'ingestion temps réel (Kafka/Spark Streaming) et de modèles décisionnels pour des clients de la distribution et de la banque.
Option Business Intelligence et Big Data.
1 septembre 2013 - 1 juillet 2018