Je vais déboguer et réparer votre pipeline de données python, sql ou pyspark
Ingénieur data senior et ingénieur produit en IA
À propos de ce service
Pipeline cassé, lent ou produisant des chiffres erronés ? Envoyez-le moi et il sera remis en marche avec la cause principale expliquée en termes simples pour que cela ne se reproduise pas.
Je suis un ingénieur de données senior qui a construit et réparé des systèmes de données en production dans la banque (y compris le travail sur l’intégration UBSCredit Suisse), la construction et les startups.
CE QUE JE RÉPARERAI
Jobs Python ou PySpark défaillants
SQL erroné, lent ou qui dépasse le délai
Airflow DAG cassés et problèmes de planification
Erreurs de jobs et notebooks Databricks
Échecs d’ingestion API
Problèmes silencieux de qualité des données (doublons, nulls, dérive)
CHAQUE LIVRAISON INCLUT
Code fonctionnel et testé
Une courte explication : ce qui a cassé, pourquoi, et comment l’éviter à l’avenir
Des conseils honnêtes si le problème réel dépasse la simple réparation
COMMENT ÇA FONCTIONNE
Envoyez-moi un message avec le code défaillant, l’erreur ou le mauvais résultat, et un exemple de données (anonymisées c’est parfait)
Je confirme la portée et le niveau avant votre commande
Vous recevez la réparation, l’explication, et au moins une révision
Vous ne savez pas quel package choisir ? Contactez-moi d’abord, je ferai une évaluation honnête et vous recommanderai l’option la moins chère qui résout le problème.
Mon portfolio
FAQ
Traduction automatique
Que dois-je vous envoyer ?
Le code ou la requête défaillante, le message d’erreur précis ou une description du résultat incorrect, ainsi qu’un exemple de données si possible. Des données anonymisées ou fictives conviennent parfaitement — je n’ai jamais besoin des identifiants de production.
Et si le problème s'avère plus gros qu'un simple bug ?
Je vous dirai tout de suite, avant de faire un travail facturable hors scope. Vous recevrez une explication claire de ce que j’ai trouvé et un devis équitable pour la réparation plus importante — sans surprises de facturation.
Pouvez-vous travailler directement dans mon environnement ?
Pour la plupart des réparations, aucun accès n’est nécessaire — je travaille à partir de votre code et de vos exemples de données. Si le problème ne se reproduit que dans votre environnement (par exemple Databricks ou ADF), nous pouvons organiser une session de partage d’écran ou une approche à accès limité. Contactez-moi pour en discuter.
Offrez-vous un support continu après la réparation ?
La livraison inclut des conseils pour prévenir les problèmes futurs. Si vous souhaitez une maintenance ou une surveillance continue, contactez-moi et nous pourrons mettre en place un arrangement personnalisé.
Quelles technologies couvrez-vous ?
Python, SQL, PySpark, Airflow, Databricks, Azure Data Factory, PostgreSQL, SQL Server et Delta Lake. Si votre stack n’est pas listée, contactez-moi — cela peut encore être dans la gamme.
