Je vais construire des pipelines de données pyspark et databricks

Certaines informations ont été traduites automatiquement.

Inde

Je parle Hindi, Anglais, Français, Espagnol

Ingénieur en données d'entreprise qui construit des pipelines automatisés et optimise SQL

Ingénieur data | Python | SQL | ETL | Spark Je conçois des pipelines de données, des workflows ETL et des solutions de données prêtes pour la production en utilisant Python, SQL, PySpark, Apache Spark...
À propos de ce service

Vous avez besoin d’aide pour traiter de grands ensembles de données avec PySpark ou Databricks ?


Je vais créer des pipelines de données évolutifs utilisant PySpark, Apache Spark et Databricks pour la transformation, le traitement et l’analyse des données.


Je peux vous aider avec :

  • Transformations et nettoyage de données avec PySpark
  • Notebooks et workflows Databricks
  • Développement de pipelines ETL/ELT
  • Traitement de données à grande échelle
  • Jointures, agrégations, filtrages et déduplication
  • Traitement incrémental et par lots
  • Validation et contrôle de la qualité des données
  • Optimisation des performances
  • Chargement de données dans des entrepôts et bases de données

Je privilégie des pipelines propres, faciles à maintenir et efficaces, avec une documentation claire.


Contactez-moi avant de commander pour des projets complexes afin que je comprenne vos données et vos besoins.

Plateforme de stockage:

Snowflake

•

Azure Synapse

•

Databricks

Type de projet:

New Build

Mon portfolio

Autres services de Data engineering I Offre