Vous souhaitez apprendre les outils et techniques les plus récents pour le traitement, la gestion et l'architecture des données ?
Je propose un enseignement et un mentorat en tête-à-tête sur l'ingénierie des données moderne dans le cloud, couvrant tout ce que vous devez savoir sur les pipelines ETL Batch/Streaming sur AWS, Databricks et Microsoft Fabric. Voici ce que je peux vous apprendre :
- ETL Batch/Streaming dans le cloud avec AWS, Databricks et Microsoft Fabric
- Traitement des données avec PySpark un cadre de traitement de données open-source de premier plan
- Architecture Lake House construire des pipelines de données modernes et évolutifs
- Pipeline ELT utilisant DBT (Data Build Tool)
- Qualité et validation des données avec Pydeequ et Great Expectations
- Modélisation des données y compris la modélisation dimensionnelle pour des architectures de données robustes
- Entrepôts de données Snowflake, BigQuery, RedShift et Microsoft Fabric (Lakehouse & Warehouse)
- Orchestration Apache Airflow, AWS Step Functions, Microsoft Fabric Data Factory Pipelines
- Services AWS Athena, Kinesis, Glue Catalog et DMS
- Data Lake utilisant AWS S3 et Microsoft OneLake
- Intégration Power BI analytique de bout en bout dans l'écosystème Microsoft Fabric
Contactez-moi pour discuter de vos objectifs d'apprentissage, et commençons