Je vais développer un pipeline ETL, ELT avec Azure Databricks et PySpark
Ingénieur de données
À propos de ce service
Vous avez des difficultés avec les pipelines de données, les processus ETL, les requêtes SQL, les transformations PySpark ou Databricks ? Je peux vous aider à concevoir, dépanner, optimiser et améliorer vos solutions d'ingénierie des données.
Je suis ingénieur en données avec plus de 3,5 ans d'expérience en Python, SQL, PySpark, Databricks, Azure, Delta Lake et pipelines ETL/ELT.
Mes services incluent :
- Conception et optimisation de pipelines ETL/ELT
- Développement, débogage et optimisation de requêtes SQL
- Transformation de données PySpark et optimisation des performances
- Solutions Azure Databricks et ADLS
- Nettoyage, validation et contrôle de la qualité des données
- Architecture Medallion et Delta Lake
- Architecture et documentation des pipelines de données
- Dépannage des workflows d'ingénierie des données existants
Je me concentre sur la compréhension de vos besoins, la fourniture de solutions pratiques et évolutives, l'écriture d'un code propre et facile à maintenir, et la garantie de résultats fiables.
Que vous ayez besoin d'aide pour une petite tâche de données ou de conseils pour un pipeline de données complet, n'hésitez pas à me contacter. Discutons de vos besoins !
