Je concevrai des pipelines de données python, ETL et automatiser les flux de travail de données
Ingénieur de données
À propos de ce service
Vous recherchez des pipelines de données ETL/ELT robustes, évolutifs et automatisés ? J’aide les entreprises à extraire, nettoyer, transformer et charger leurs données de manière fluide dans des bases de données modernes et des entrepôts de données cloud.
Fort de plus de 2 ans d’expérience pratique en Data Engineering, je me spécialise dans la création de flux de travail de données fiables et tolérants aux pannes en utilisant Python, SQL et AWS.
Ce que je peux faire pour vous :
Pipelines ETL/ELT personnalisés : ingestion automatisée via API REST, webhooks, bases de données ou fichiers plats (CSV/JSON/Parquet).
Entrepôts de données cloud : conception de schémas, modélisation et chargement dans Snowflake, AWS
Optimisation et réglage des requêtes : accélérer les requêtes SQL lentes et résoudre les goulets d’étranglement de performance.
Orchestration de flux de travail : planification, cartographie des dépendances et alertes automatisées avec Apache Airflow.
Streaming de données en temps réel : pipelines en quasi temps réel avec Apache Kafka.
Qualité des données et tests automatisés : mise en place de vérifications de validation et tests unitaires pytest pour éviter la corruption des données.
Pile technologique et outils :
Langages : Python, SQL
Bases de données et entrepôts : Snowflake, MySQL
Cloud et Big Data : AWS (S3), Kafka, Airflow
Veuillez m’envoyer un message avec le format de vos données et vos besoins avant de passer commande !
Destination Platform:
Snowflake
•
Amazon S3
Outils et plateformes:
Autres
FAQ
Traduction automatique
De quels détails avez-vous besoin de ma part avant de commencer ?
Veuillez fournir un aperçu de vos besoins, des fichiers ou schémas d’entrée, des détails de la base de données ou de la destination, ainsi que les identifiants API ou permissions nécessaires.
Dans quels outils et technologies êtes-vous spécialisé ?
Je me spécialise en Python et SQL pour la création de scripts d’ingestion, de transformation automatisés et de flux de travail de bases de données. Je travaille principalement avec API REST, fichiers plats (CSV, JSON, Excel) et bases relationnelles.
Et si mes besoins ne correspondent pas aux packages prédéfinis ?
Pas de problème. Chaque architecture de données est unique. Envoyez-moi un message expliquant votre configuration, et je créerai une offre personnalisée adaptée à votre portée et votre calendrier précis.
Comment garantissez-vous la précision des données et la fiabilité du pipeline ?
J’applique des règles de validation de schéma, des contrôles de qualité, la gestion des cas limites (null ou doublons) et des tests unitaires automatisés pour assurer un fonctionnement fiable sans erreurs silencieuses.
Fournissez-vous de la documentation et un support après livraison ?
Oui. Chaque livraison terminée comprend une documentation claire de la configuration et des commentaires dans le code pour que vous puissiez facilement maintenir et faire fonctionner le pipeline à l’avenir.

