Je serai votre ingénieur de données pour Databricks PySpark ETL et solutions Lakehouse
Ingénieur en données cloud
À propos de ce service
Je vais construire des pipelines de données robustes et des solutions lakehouse en utilisant Databricks, PySpark, Apache Spark, Spark SQL et Delta Lake.
Ce que je peux réaliser :
pipelines ETL/ELT Databricks
Transformations de données PySpark
Traitement par lots des données
Solutions Delta Lake
Architecture Medallion
couches de données Bronze, Silver et Gold
Traitement incrémental des données
Nettoyage et validation des données
SCD Type 1 / Type 2
Modélisation des données et jeux de données prêts pour l’analyse
Je peux travailler avec des données structurées provenant de fichiers CSV, d’API, de bases de données et d’autres sources supportées, et les transformer en jeux de données propres et fiables pour l’analyse et les applications en aval.
Veuillez me contacter avant de commander afin que je puisse examiner vos besoins et recommander le package approprié.
Mon portfolio
Autres services de Data engineering I Offre
FAQ
Traduction automatique
Dois-je vous contacter avant de commander ?
Oui. Veuillez envoyer vos sources de données, échantillons, exigences de transformation, résultat attendu et portée du projet afin que je puisse recommander le package approprié ou fournir une offre personnalisée.
Proposez-vous des solutions complètes de bout en bout ?
Oui. Pour des projets plus importants, je peux intervenir sur l'ingestion, le stockage, la transformation, la modélisation des données et les couches de données prêtes pour l’analyse.
Avec quelles sources de données pouvez-vous travailler ?
Je peux travailler avec CSV, JSON, Excel, APIs REST et bases de données relationnelles comme SQL Server, en fonction des besoins du projet.

