Je vais construire un pipeline ETL python pour csv, Excel, API et SQL

Certaines informations ont été traduites automatiquement.

Pakistan

Je parle Ourdou, Anglais

Ingénieur backend et data spécialisé dans la création d'API, de bases de données et de systèmes ETL évolutifs

Je conçois et développe les bases de données et les backends derrière des produits riches en données. Architecture PostgreSQL/MySQL, SaaS multi-tenant avec isolation des locataires au niveau de la bas...
À propos de ce service

Si vos données sont trop volumineuses, trop désorganisées ou trop manuelles en ce moment, je vais les automatiser.


Preuve : j'ai créé un pipeline traitant plus de 2 milliards de lignes pour une plateforme financière, et j'ai transformé un ensemble de données brutes de 7 Go, contenant plus de 2 millions de documents, en un lac de données structuré et consultable en deux semaines, en solo.


Ce que je construis :

Pipeline ETL personnalisé (extraire, nettoyer, transformer, charger)

Gestion de grands ensembles de données sans crash de mémoire

Pipeline réutilisable et idempotent

Validation des données et contrôles de qualité

Chargement dans PostgreSQL, MySQL ou Parquet

Journalisation et gestion des erreurs

Mise en place de la planification/automatisation


Sources : CSV, Excel, JSON, REST APIs, PostgreSQL, MySQL, SQLite, Parquet.


Envoyez-moi un échantillon de vos données et votre objectif final, et je définirai la portée du pipeline avant votre commande.


pipeline ETL

python

ingénierie des données

nettoyage des données

automatisation



Destination Platform:

Databricks Lakehouse

PostgreSQL

mySQL

Outils et plateformes:

Kafka Connect

Autres

Mon portfolio