Je vais construire des pipelines ETL en Python pour votre data warehouse
Stagiaire en ingénierie produit
À propos de ce service
Je suis étudiant en ingénierie informatique avec une expérience pratique dans la construction de pipelines ETL et de solutions d'ingénierie des données utilisant Python, SQL et Databricks. Grâce à des stages, j'ai développé des services backend et des API REST qui traitent des données à grande échelle (plus de 120 millions d'enregistrements), intégré Databricks, Unity Catalog et Delta Tables dans des flux de travail en production, et mis en place des pipelines de validation et de nettoyage des données pour des équipes d'ingénierie.
Ce que je propose :
Conception et développement de pipelines ETL (extraire, transformer, charger)
Connectivité aux sources de données (bases de données, API, fichiers)
Nettoyage, mise en forme et validation des données
Flux de travail Databricks et Delta Table
Intégration API pour des flux de données automatisés
Code propre, documenté et réutilisable
Je me concentre sur la création de pipelines fiables, bien structurés et faciles à maintenir, pas seulement sur des scripts rapides.
Je communique clairement tout au long du projet et je respecte les délais de livraison.
Technologie:
Apache Spark
•
Java
•
Python
•
R
•
SQL
•
Databricks
Mon portfolio
FAQ
Traduction automatique
Travaillez-vous avec d'autres data warehouses que Databricks ?
Databricks est mon domaine d'expertise principal. Pour d'autres plateformes, contactez-moi d'abord pour confirmer si je peux m'adapter. Mais je peux travailler dessus une fois que je me suis familiarisé.
Vais-je obtenir le code source ?
Oui, inclus dans le package Premium (ou en option supplémentaire).
Pouvez-vous gérer plusieurs sources de données ?
Oui — les packages Standard et Premium supportent plusieurs sources.
De quelles informations avez-vous besoin pour commencer ?
Votre(s) source(s) de données, la sortie ou le data warehouse cible, et toute logique de transformation spécifique.
