Je vais concevoir des pipelines d'ingénierie des données pour des projets de big data
Ingénieur de données senior
À propos de ce service
Construisez des pipelines de données fiables, évolutifs et prêts pour le cloud avec un professionnel de l'ingénierie des données ayant plus de 10 ans d'expérience.
Je me spécialise dans le développement de pipelines ETL et ELT de bout en bout qui automatisent l'ingestion, la transformation, la validation et le chargement des données dans des environnements cloud et sur site.
Mes services incluent :
- Développement de pipelines ETL/ELT
- Traitement de données par lots et incrémentiel
- Intégration API, base de données et fichiers
- Nettoyage et transformation des données
- Vérification de la qualité et validation des données
- Intégration de data lake et data warehouse
- Orchestration de pipelines, journalisation et gestion des erreurs
- Migration vers le cloud et conception d'architecture
Technologies : Python, SQL, Pyspark, GraphDB (Neo4j), Databricks, Azure Data Factory, Azure Data Lake Storage, AWS Glue, Amazon S3, BigQuery et bases de données relationnelles.
Je fournis des solutions propres, faciles à maintenir et bien documentées, adaptées à vos besoins spécifiques.
Veuillez me contacter avant de passer commande afin que je comprenne vos sources de données, vos exigences et la complexité de votre projet.
Outils et plateformes:
Azure Data Factory
FAQ
Traduction automatique
De quelles informations avez-vous besoin pour commencer ?
Veuillez partager vos sources de données, le système cible, un échantillon de données ou le schéma, vos exigences de transformation, la technologie préférée et le résultat attendu
Quels types de sources de données supportez-vous ?
Je travaille avec des bases de données, des API REST, CSV, JSON, Excel, stockage cloud, ainsi que des données structurées ou semi-structurées.
Quelles technologies et plateformes cloud utilisez-vous ?
Je travaille avec Python, SQL, Pyspark, Databricks, Azure Data Factory, Azure Data Lake, AWS Glue, Amazon S3, BigQuery et des bases de données relationnelles.
Pouvez-vous créer des pipelines incrémentiels ou en temps réel ?
Oui. Je peux développer des pipelines batch, incrémentiels et en temps réel en fonction du volume de données, des besoins métier et de la stack technologique.
Dois-je vous contacter avant de passer une commande ?
Oui. Veuillez me contacter avant de commander pour que je puisse examiner la portée de votre projet, sa complexité, le volume de données, les intégrations nécessaires et le délai de livraison.
