Il semble que ce service ait été suspendu

Je concevrai des modèles big data et des pipelines ETL avec pyspark et databricks

Certaines informations ont été traduites automatiquement.

Inde

Je parle Hindi, Gujarati, Anglais

34 commandes terminées

Expert en ingénierie des données et architecte de solutions cloud

Ingénieur data Azure expérimenté avec plus de 13 ans dans la création de solutions de données évolutives utilisant Microsoft Fabric, Azure Data Factory (ADF), Azure Data Lake et Synapse Analytics. Je ...
À propos de ce service

Traitez des pétaoctets de données à une vitesse fulgurante avec des modèles PySpark optimisés et des pipelines Databricks qui évoluent à l'infini.


Vous êtes submergé par d'énormes ensembles de données qui font planter les systèmes traditionnels ? Besoin d’un traitement en temps réel capable de gérer des milliards d’enregistrements sans effort ? Vous avez trouvé votre architecte big data.


Ce que vous obtiendrez :

  • Modèles et transformations de données PySpark évolutifs
  • Configurations optimisées pour le cluster Databricks
  • Architecture Delta Lake pour des transactions ACID
  • Pipeline de traitement en temps réel et par lots
  • Requêtes Spark SQL optimisées pour la performance
  • Stratégies d’optimisation des coûts et configuration de surveillance


Mon expertise en Big Data :

Avec plus de 13 ans à concevoir des solutions Spark, j’ai construit des pipelines traitant plus de 500 TB par jour pour des géants de la tech, avec des améliorations de performance de 10 fois grâce à des techniques d’optimisation avancées et au tuning des clusters.


Technologies que je maîtrise :

  • Plateformes : Databricks, Apache Spark, Delta Lake, MLflow
  • Langages : PySpark, Scala, Spark SQL, Python
  • Optimisation : optimiseur Catalyst, partitionnement, stratégies de mise en cache

Langue:

Anglais

Expertise technique:

Apache Spark

Databricks

Snowflake

Expertise:

Pipelines de data

Développement ETL

Secteur:

Analyse de données

Services financiers