Je vais construire des pipelines de données en temps réel avec kafka, airflow et spark
Python, ingénierie des données, APIs et automatisation IA
À propos de ce service
Vous avez besoin d’un pipeline de données fiable capable de gérer des charges de travail en production ?
Je vais créer des pipelines de données évolutifs et faciles à maintenir pour le traitement par lots ou en temps réel en utilisant des technologies telles que Python, Airflow, Kafka, Spark, SQL, PostgreSQL, AWS et GCP
Je peux vous aider avec :
- pipelines ETL / ELT
- flux de travail Apache Airflow
- pipelines de streaming Kafka
- traitement Spark / PySpark
- intégration API et bases de données
- nettoyage et transformation des données
- validation des données et gestion des erreurs
- intégration de data warehouse / data lake
- déploiements Dockerisés
- surveillance et améliorations en production
Je possède plus de 10 ans d’expérience en ingénierie logicielle dans les domaines Backend, Data Engineering, Cloud et DevOps, y compris des systèmes à haut volume traitant de grands ensembles de données et des centaines de milliers d’événements par jour.
Vous recevrez un code propre, facile à maintenir, une documentation claire et une solution adaptée à vos besoins réels.
Vous avez une pipeline complexe ou un problème en production ?
Contactez-moi avant de commander et je vous aiderai à choisir la bonne architecture et le bon package.

