Je vais rédiger des requêtes SQL et créer des pipelines ETL automatisés
À propos de ce service
Arrêtez de lutter avec des données désordonnées. Construisons des systèmes automatisés qui fonctionnent pour vous !
Vous gérez des bases de données mal organisées, des pipelines de données cassés ou des tâches manuelles sur Excel qui vous font perdre un temps précieux ? Je suis un ingénieur en données professionnel, prêt à nettoyer, traiter et automatiser vos flux de travail de données.
Je me spécialise dans la transformation de données brutes et non structurées en ensembles de données propres et structurés, ainsi qu’en pipelines ETL (Extract, Transform, Load) automatisés. Que vous ayez besoin d’automatisation en Python, d’optimisation de bases de données ou de web scraping fiable, je fournis du code prêt pour la production.
️Services principaux que je propose :
- Développement de pipelines ETL : Automatiser la collecte de données à partir d’API, CSV ou sources web directement dans votre base de données.
- Nettoyage et prétraitement des données : Corriger les valeurs manquantes, supprimer les doublons et structurer des données désordonnées en utilisant Python (Pandas/NumPy).
- Conception de bases de données et optimisation SQL : Rédiger des requêtes SQL efficaces, concevoir des schémas de bases de données et réparer des bases de données lentes.
- Web scraping avancé : Extraire de grandes quantités de données de sites web de manière sûre et légale, en formats JSON ou Excel structurés.
- Intégration de données : Connecter différentes sources de données (par exemple Shopify, Stripe, HubSpot) à des entrepôts de données centraux comme BigQuery ou PostgreSQL.
Technologie:
Apache Spark
•
Excel
•
Python
•
SQL
•
Snowflake
•
Databricks
