Je serai votre ingénieur de données pour Databricks PySpark ETL et solutions Lakehouse

Certaines informations ont été traduites automatiquement.

Pakistan

Je parle Anglais

Ingénieur en données cloud

Bonjour, je suis Soban, un ingénieur data avec plus de 3 ans d'expérience pratique dans la conception et la mise en œuvre de solutions de données complètes. Je me spécialise dans Snowflake, Airflow, K...
À propos de ce service

Je vais construire des pipelines de données robustes et des solutions lakehouse en utilisant Databricks, PySpark, Apache Spark, Spark SQL et Delta Lake.

Ce que je peux réaliser :

pipelines ETL/ELT Databricks

Transformations de données PySpark

Traitement par lots des données

Solutions Delta Lake

Architecture Medallion

couches de données Bronze, Silver et Gold

Traitement incrémental des données

Nettoyage et validation des données

SCD Type 1 / Type 2

Modélisation des données et jeux de données prêts pour l’analyse

Je peux travailler avec des données structurées provenant de fichiers CSV, d’API, de bases de données et d’autres sources supportées, et les transformer en jeux de données propres et fiables pour l’analyse et les applications en aval.

Veuillez me contacter avant de commander afin que je puisse examiner vos besoins et recommander le package approprié.

Expertise:

Intégration API

•

Big data

•

Extraction des données

Technologie:

Apache Kafka

•

Apache Spark

•

Python

•

SQL

•

Snowflake

Mon portfolio