Je vais construire des pipelines ETL de données dans Azure Databricks en utilisant pyspark et sql

Certaines informations ont été traduites automatiquement.

Pakistan

Je parle Allemand, Japonais, Chinois, Anglais

199 commandes terminées

"Faites votre travail de manière efficace et professionnelle"

Je suis un écrivain professionnel, un transcripteur et un assistant virtuel. Je suis un expert en transcription, rédaction d'articles, saisie de données, copier-coller, recherche d'e-mails, recherche ...

Niveau 2

Répond à des critères de performance élevés et a fait ses preuves en matière de satisfaction clients.

À propos de ce service

Vous avez besoin de données propres, fiables et prêtes pour l’analyse ? Je crée des pipelines ETL de qualité production dans Azure Databricks qui transforment des données brutes dispersées en ensembles de données fiables que votre équipe peut réellement utiliser.

Je suis un ingénieur data avec plus de 4 ans d’expérience et plus de 150 projets livrés, spécialisé en Databricks, PySpark et l’architecture Medallion (Bronze à Silver à Gold).

Ce que vous obtenez :

Des pipelines ETL/ELT de bout en bout dans Azure Databricks

Ingestion de données depuis SQL, API, fichiers et plusieurs sources

Transformations, nettoyage et agrégation avec PySpark

Tables Delta Lake avec métadonnées d’audit (clés de hachage, ID de run, horodatages)

Configuration et gouvernance du Unity Catalog

Validation des données et contrôles de qualité

Pourquoi me choisir :

Un code propre, documenté, facile à maintenir et livré à temps, à chaque fois. Mes pipelines ETL dans Databricks sont conçus pour évoluer et être faciles à transmettre.

Contactez-moi avant de commander pour que je puisse confirmer le périmètre et vous donner un devis précis.

Destination Platform:

Snowflake

Azure Synapse Analytics

Outils et plateformes:

Google Cloud Dataflow

Kafka Connect