Je vais construire des pipelines ETL avec pyspark et databricks

Certaines informations ont été traduites automatiquement.

Népal

Je parle Népalais, Hindi, Anglais

Ingénieur de données

Je suis ingénieur en données et backend avec plus de 5 ans d'expérience dans la création de pipelines ETL évolutifs, de plateformes de données cloud et de systèmes backend solides. Mon expertise couvr...
À propos de ce service

Bonjour, je suis Arbind Sah, et je peux vous aider à concevoir des pipelines ETL évolutifs, traiter de Big Data ou optimiser des systèmes basés sur le cloud.

Je me spécialise dans Python, SQL et les outils natifs du cloud pour simplifier l’intégration de données, l’automatisation et l’analyse pour des entreprises de toutes tailles.


Ce que je peux faire pour vous :

-Conception et optimisation de pipelines ETL & Data en utilisant PySpark et Databricks pour une transformation de données fiable et prête pour la production.Solutions Utilisez Redshift, BigQuery, Spark et Databricks pour gérer efficacement de grands ensembles de données.

-Infrastructure cloud : Construire et gérer l’infrastructure sur AWS (EC2, RDS, S3, Lambda) et GCP, y compris les déploiements conteneurisés avec Docker.

-Optimisation et sécurité des bases de données : Améliorer les performances des requêtes, mettre en place une sécurité robuste et assurer la conformité avec les normes du secteur.

-Migration de données et réconciliation de schémas : Migrer et consolider des données entre PostgreSQL, MySQL et plateformes cloud, en gérant les incompatibilités de types, les valeurs nulles et la cartographie complexe des schémas.


Avec une forte orientation vers l’informatique en nuage, l’automatisation des données et l’analyse, je garantis des solutions de données évolutives, sécurisées et performantes.

Contactez-moi pour optimiser vos flux de données afin d’obtenir une efficacité maximale !

Destination Platform:

Google BigQuery

Databricks Lakehouse

Outils et plateformes:

Airbyte

AWS Glue DataBrew

Mon portfolio