Parcourir les catégories
Explorer
Fiverr Pro
Français
$
USD
Pakistan
6 commandes terminées
Je vais créer un pipeline ETL (Extract. Transform, Load) pour vous dans Pyspark. Selon vos préférences, je peux créer le pipeline ETL soit dans AWS Glue, soit dans des databricks en utilisant le code Pyspark.
En utilisant Pyspark, j'obtiendrai des données de la source, qu'il s'agisse d'une base de données, d'une API ou de données stockées dans le compartiment AWS S3 ou dans le lac de données Azure.
Une fois les données chargées de la source dans la zone de préparation, je les transformerai selon votre logique métier et les chargerai dans votre zone cible.
La zone cible peut être soit un lac de données comme le compartiment S3, un entrepôt de données comme Redshift ou un autre endroit.