Je vais construire des pipelines de données en temps réel avec kafka, airflow et spark

Certaines informations ont été traduites automatiquement.

Turquie

Je parle Turc, Anglais

Python, ingénierie des données, APIs et automatisation IA

🚀 Problème complexe ? Simplifions-le. Je suis ingénieur logiciel et chef de projet technique avec plus de 10 ans d’expérience en Backend, Data, Cloud et DevOps. Je construis des API évolutives, des...
À propos de ce service

Vous avez besoin d’un pipeline de données fiable capable de gérer des charges de travail en production ?


Je vais créer des pipelines de données évolutifs et faciles à maintenir pour le traitement par lots ou en temps réel en utilisant des technologies telles que Python, Airflow, Kafka, Spark, SQL, PostgreSQL, AWS et GCP


Je peux vous aider avec :

  • pipelines ETL / ELT
  • flux de travail Apache Airflow
  • pipelines de streaming Kafka
  • traitement Spark / PySpark
  • intégration API et bases de données
  • nettoyage et transformation des données
  • validation des données et gestion des erreurs
  • intégration de data warehouse / data lake
  • déploiements Dockerisés
  • surveillance et améliorations en production


Je possède plus de 10 ans d’expérience en ingénierie logicielle dans les domaines Backend, Data Engineering, Cloud et DevOps, y compris des systèmes à haut volume traitant de grands ensembles de données et des centaines de milliers d’événements par jour.


Vous recevrez un code propre, facile à maintenir, une documentation claire et une solution adaptée à vos besoins réels.


Vous avez une pipeline complexe ou un problème en production ?

Contactez-moi avant de commander et je vous aiderai à choisir la bonne architecture et le bon package.

Destination Platform:

Amazon Redshift

•

ClickHouse

•

PostgreSQL

Outils et plateformes:

Airbyte

•

Google Cloud Dataflow