Je vais construire des pipelines ETL en Python avec Apache Airflow et AWS
Développeur Python, ingénieur en données, web scraping, Power BI
À propos de ce service
Vous souhaitez automatiser vos flux de données et éliminer le traitement manuel des données ?
Je crée des pipelines ETL Python fiables utilisant Apache Airflow, SQL et AWS pour extraire, transformer, valider et charger des données provenant d’APIs, de bases de données, de fichiers CSV/Excel et d’autres sources vers votre destination préférée.
Je suis ingénieur en données avec plus de 4 ans d’expérience dans la création de pipelines ETL évolutifs, l’automatisation des flux de travail et les solutions d’intégration de données.
SERVICES QUE JE PROPOSE :
- pipelines ETL en Python
- Développement de DAG Apache Airflow
- Intégration API, CSV, Excel, JSON et bases de données
- Migration de bases de données
- Automatisation SQL
- Nettoyage et validation de données
- Automatisation des flux de travail
- Déploiement AWS (EC2, S3, RDS)
PARFAIT POUR :
- pipelines ETL
- Intégration de données
- Migration de données
- Entrepôts de données
- Automatisation des flux de travail
TECHNOLOGIES :
Python, SQL, Apache Airflow, PySpark, Pandas, AWS (S3, EC2, RDS, Glue), PostgreSQL, MySQL, MongoDB, Redis, Qdrant Vector DB, REST APIs, Kafka, Selenium, BeautifulSoup, Scrapy, Git, Linux.
POURQUOI TRAVAILLER AVEC MOI ?
- Solutions prêtes pour la production
- Code propre, évolutif et facile à maintenir
- Communication rapide
- Livraison à temps
Veuillez m’envoyer un message avant de passer commande pour des projets complexes ou personnalisés.
Mon portfolio
FAQ
Traduction automatique
Avec quelles sources de données pouvez-vous travailler ?
Je peux créer des pipelines ETL qui fonctionnent avec REST APIs, MySQL, PostgreSQL, MongoDB, CSV, Excel, JSON, stockage cloud et autres sources de données structurées. Si vous avez un doute, envoyez-moi vos exigences et je confirmerai la compatibilité.
Pouvez-vous automatiser et planifier des pipelines ETL ?
Oui. J’utilise Apache Airflow pour planifier, surveiller et automatiser les flux ETL avec retries, journalisation et gestion des erreurs pour assurer une exécution fiable.
Fournissez-vous de la documentation?
Oui. Les packages standard et premium incluent une documentation expliquant l’architecture du pipeline, la configuration, le flux de travail, pour faciliter la maintenance.
Pouvez-vous déployer le pipeline sur AWS ou mon serveur ?
Oui. Je peux déployer des pipelines ETL sur des services AWS tels qu’EC2, S3, RDS, ou sur des serveurs VPS Linux, selon vos besoins.
Mon projet ne correspond pas à vos packages. Pouvez-vous quand même aider ?
Absolument. Chaque projet d’ingénierie des données est différent. Envoyez-moi vos exigences, et je les examinerai pour vous proposer une offre personnalisée adaptée à vos besoins et votre budget.

