Je vais optimiser les solutions de données sql server, tsql et pyspark
Développeur SQL senior, Data Engineer TSQL, SSIS, SSRS, PySpark, AWS 14 ans d’expérience
À propos de ce service
Je réaliserai de l'ingénierie de big data en utilisant pyspark, hive sql, hdfs et sql
Vous souhaitez exploiter tout le potentiel de vos ensembles de données massifs ? Avez-vous besoin de pipelines de données optimisés et évolutifs qui fonctionnent parfaitement ? Vous êtes au bon endroit !
En tant que Data Engineer expérimenté, je me spécialise dans la construction d'architectures Big Data robustes et de workflows ETL efficaces. Que vous ayez besoin de nettoyer des données non structurées, de migrer des architectures ou d'optimiser des requêtes de recherche lourdes, je fournis des solutions prêtes pour la production, hautement optimisées et adaptées à vos besoins commerciaux.
️ Services que je propose :
Optimisation de requêtes SQL : Rédaction de requêtes relationnelles complexes, procédures stockées, optimisation des performances et indexation de bases de données.
Développement PySpark : Pipelines ETL batch et streaming personnalisés utilisant PySpark RDDs, DataFrames et Spark SQL.
Hive & Hive-SQL : Conception de schémas Hive optimisés, tables externes/gestionnées, partitionnement, bucketing et rédaction de requêtes Hive-SQL haute performance.
HDFS & gestion du stockage : Architecture de structures de stockage distribuées, gestion des formats de fichiers (Parquet, ORC, Avro) et ingestion de données.
Pipeline de données de bout en bout : Construction de workflows de données évolutifs pour transformer les données brutes en données propres et prêtes à l’analyse
