Je vais construire un pipeline ETL python pour csv, Excel, API et SQL
Ingénieur backend et data spécialisé dans la création d'API, de bases de données et de systèmes ETL évolutifs
À propos de ce service
Si vos données sont trop volumineuses, trop désorganisées ou trop manuelles en ce moment, je vais les automatiser.
Preuve : j'ai créé un pipeline traitant plus de 2 milliards de lignes pour une plateforme financière, et j'ai transformé un ensemble de données brutes de 7 Go, contenant plus de 2 millions de documents, en un lac de données structuré et consultable en deux semaines, en solo.
Ce que je construis :
Pipeline ETL personnalisé (extraire, nettoyer, transformer, charger)
Gestion de grands ensembles de données sans crash de mémoire
Pipeline réutilisable et idempotent
Validation des données et contrôles de qualité
Chargement dans PostgreSQL, MySQL ou Parquet
Journalisation et gestion des erreurs
Mise en place de la planification/automatisation
Sources : CSV, Excel, JSON, REST APIs, PostgreSQL, MySQL, SQLite, Parquet.
Envoyez-moi un échantillon de vos données et votre objectif final, et je définirai la portée du pipeline avant votre commande.
pipeline ETL
python
ingénierie des données
nettoyage des données
automatisation
Outils et plateformes:
Kafka Connect
•
Autres
Mon portfolio
FAQ
Traduction automatique
Quelle taille de dataset pouvez-vous gérer ?
J'ai traité plus de 2 milliards de lignes en utilisant des techniques de streaming ou de traitement par morceaux.
Cela peut-il fonctionner selon un calendrier ?
Oui, les exécutions programmées ou déclenchées sont incluses dans les offres Standard ou Premium.

