Je vais construire des pipelines ETL avec Databricks et PySpark
Ingénieur de données
À propos de ce service
Vous avez du mal avec des données désorganisées, des pipelines cassés ou des tableaux de bord qui ne racontent pas la vraie histoire ? Je peux vous aider.
Je suis ingénieur en données avec plus de 4 ans d’expérience pratique dans la conception, la construction et l’optimisation de pipelines de données de bout en bout et de plateformes de données cloud.
CE QUE JE PEUX FAIRE POUR VOUS :
- Construire et orchestrer des pipelines ETL/ELT avec Apache Airflow
- Concevoir et gérer des entrepôts de données cloud sur Snowflake et Databricks
- Rédiger du SQL et du Python (PySpark) efficaces, de niveau production, pour la transformation de données à grande échelle
- Migrer des workflows legacy (par exemple Hive/Oozie) vers des pipelines modernes Databricks/Airflow
- Nettoyer, transformer et modéliser des données brutes en tables prêtes pour l’analyse
- Optimiser les pipelines existants pour la performance (partitionnement, mise en cache, chargements incrémentiels)
- Créer des tableaux de bord dans Power BI, Tableau ou Qlik à partir de votre pipeline
POURQUOI TRAVAILLER AVEC MOI :
- Expérience concrète sur des projets complets de la collecte à la visualisation
- Communication claire tout au long du projet, pas seulement un rendu de code
- J’explique ce que j’ai construit et pourquoi, pour que vous ne soyez jamais bloqué avec une boîte noire que vous ne comprenez pas

