Je vais déboguer et réparer votre pipeline de données python, sql ou pyspark

Certaines informations ont été traduites automatiquement.

Royaume-Uni

Je parle Anglais, Russe

Ingénieur data senior et ingénieur produit en IA

Ingénieur data senior qui conçoit des plateformes de données en production, des pipelines ETL et des produits d'IA dans les secteurs des services financiers, de la construction et des startups. J'ai t...
À propos de ce service

Pipeline cassé, lent ou produisant des chiffres erronés ? Envoyez-le moi et il sera remis en marche avec la cause principale expliquée en termes simples pour que cela ne se reproduise pas.

Je suis un ingénieur de données senior qui a construit et réparé des systèmes de données en production dans la banque (y compris le travail sur l’intégration UBSCredit Suisse), la construction et les startups.

CE QUE JE RÉPARERAI

Jobs Python ou PySpark défaillants

SQL erroné, lent ou qui dépasse le délai

Airflow DAG cassés et problèmes de planification

Erreurs de jobs et notebooks Databricks

Échecs d’ingestion API

Problèmes silencieux de qualité des données (doublons, nulls, dérive)

CHAQUE LIVRAISON INCLUT

Code fonctionnel et testé

Une courte explication : ce qui a cassé, pourquoi, et comment l’éviter à l’avenir

Des conseils honnêtes si le problème réel dépasse la simple réparation

COMMENT ÇA FONCTIONNE

Envoyez-moi un message avec le code défaillant, l’erreur ou le mauvais résultat, et un exemple de données (anonymisées c’est parfait)

Je confirme la portée et le niveau avant votre commande

Vous recevez la réparation, l’explication, et au moins une révision

Vous ne savez pas quel package choisir ? Contactez-moi d’abord, je ferai une évaluation honnête et vous recommanderai l’option la moins chère qui résout le problème.

Destination Platform:

Azure Synapse Analytics

Outils et plateformes:

Fivetran

•

Airbyte

•

Microsoft SSIS

Mon portfolio