Je construirai des pipelines de données en utilisant databricks, pyspark, azure et sql
Ingénieur de données senior
À propos de ce service
Je vais construire, optimiser ou dépanner des pipelines de données en utilisant Databricks, PySpark, Azure Data Factory, Azure Data Lake, Delta Lake et SQL.
Fort de plus de 5 ans d’expérience en ingénierie de données d’entreprise, je peux vous aider à transformer des données brutes en pipelines fiables, évolutifs et faciles à maintenir.
Mes services incluent :
Développement de pipelines ETL/ELT
Développement Databricks & PySpark
Orchestration Azure Data Factory
Ingestion et transformation de données
Développement et optimisation SQL
Solutions Delta Lake
Traitement par lots et incrémental
Vérification de la qualité des données et validation
Dépannage et optimisation des pipelines
Migration de données vers Databricks
Tests unitaires et documentation technique
Que vous ayez besoin d’un nouveau pipeline, de réparer un workflow existant ou de moderniser une plateforme de données, je peux travailler avec votre architecture et vos exigences existantes.
Je privilégie une mise en œuvre propre, un traitement Spark évolutif, des workflows de données fiables et une documentation claire.
Veuillez m’envoyer un message avant de passer commande avec vos exigences, détails sur la source et la cible, et les livrables attendus afin que je puisse confirmer la portée et recommander le package approprié.
Outils et plateformes:
Azure Data Factory
•
Autres
FAQ
Traduction automatique
1. Avec quelles technologies travaillez-vous ?
Databricks, PySpark, Azure Data Factory, Azure Data Lake, Delta Lake, SQL, et les services de données Azure associés.
2. Pouvez-vous construire un pipeline ETL complet ?
Oui. Selon le package choisi, je peux gérer l’ingestion, la transformation, l’orchestration, les vérifications de la qualité des données, les tests et la documentation.
3. Pouvez-vous réparer un pipeline Databricks ou PySpark existant ?
Oui. Je peux dépanner les erreurs, revoir le code existant, identifier les goulets d’étranglement et mettre en œuvre des améliorations.
4. Pouvez-vous migrer des pipelines existants vers Databricks ?
Oui. Je peux aider à migrer et moderniser les charges de travail de données existantes en utilisant Databricks, PySpark et Delta Lake.
5. Quelles informations avez-vous besoin pour commencer ?
Veuillez fournir vos exigences, systèmes source et cible, exemples de données ou schémas si applicable, code ou pipelines existants, et résultats attendus.
6. Pouvez-vous gérer des exigences personnalisées ?
Oui. Si votre besoin ne correspond pas aux packages listés, veuillez me contacter d’abord afin que nous puissions définir la portée et créer une offre personnalisée.
