Je vais construire des pipelines ETL avec Databricks et PySpark

Certaines informations ont été traduites automatiquement.

Inde

Je parle Anglais

Ingénieur de données

Ingénieur en données avec plus de 4 ans d’expérience dans la création de pipelines ETL/ELT évolutifs et de plateformes de données cloud. Compétent en Databricks, Snowflake, Apache Airflow, PySpark, SQ...
À propos de ce service

Vous avez du mal avec des données désorganisées, des pipelines cassés ou des tableaux de bord qui ne racontent pas la vraie histoire ? Je peux vous aider.


Je suis ingénieur en données avec plus de 4 ans d’expérience pratique dans la conception, la construction et l’optimisation de pipelines de données de bout en bout et de plateformes de données cloud.


CE QUE JE PEUX FAIRE POUR VOUS :

- Construire et orchestrer des pipelines ETL/ELT avec Apache Airflow

- Concevoir et gérer des entrepôts de données cloud sur Snowflake et Databricks

- Rédiger du SQL et du Python (PySpark) efficaces, de niveau production, pour la transformation de données à grande échelle

- Migrer des workflows legacy (par exemple Hive/Oozie) vers des pipelines modernes Databricks/Airflow

- Nettoyer, transformer et modéliser des données brutes en tables prêtes pour l’analyse

- Optimiser les pipelines existants pour la performance (partitionnement, mise en cache, chargements incrémentiels)

- Créer des tableaux de bord dans Power BI, Tableau ou Qlik à partir de votre pipeline


POURQUOI TRAVAILLER AVEC MOI :

- Expérience concrète sur des projets complets de la collecte à la visualisation

- Communication claire tout au long du projet, pas seulement un rendu de code

- J’explique ce que j’ai construit et pourquoi, pour que vous ne soyez jamais bloqué avec une boîte noire que vous ne comprenez pas


Langue:

Anglais

Expertise technique:

dbt (Data Build Tool)

Apache Spark

Expertise:

Pipelines de data

Développement ETL

Secteur:

Analyse de données

Mon portfolio