Je vais construire un entrepôt de données et optimiser les pipelines ETL BigQuery sur Google Cloud
À propos de ce service
Je vais créer vos pipelines de données sur Google Cloud et réduire votre facture BigQuery.
Je suis un ingénieur en données qui a géré toute la stack BigQuery en production, actuellement Lead/Senior Data Engineer, où j'ai réduit les dépenses mensuelles de BigQuery de 96 % (de 13 000 $ à 500 $) tout en triplant le volume des requêtes, en redesignant les schémas et en optimisant les requêtes.
Ce que je fais :
- Construire des pipelines ETL vers BigQuery depuis des APIs, exports GA4/Firebase, GCS ou bases de données
- Unifier GA4, Firebase, Adjust, RevenueCat, Google Ads dans un seul modèle BigQuery
- Réduire les coûts BigQuery via la refonte des schémas, partitionnement/clustering, optimisation des requêtes
- Mettre en place une orchestration planifiée (Airflow, Cloud Composer, Pub/Sub)
- Construire des couches de transformation avec Dataform
- Automatiser les workflows de reporting avec Python et APIs
- Configurer des interrupteurs de facturation par projet
- Créer et optimiser des entrepôts de données et des data lakes
- Créer des tableaux de bord directement depuis l’entrepôt
Ma méthode de travail : vous partagez l’accès en lecture à GCP, j’audite les coûts des pipelines/requêtes, je construis ou refactorise et valide, vous recevez la documentation et un appel de transfert.
Outils : GCP, BigQuery, Cloud Storage, Pub/Sub, Airflow, Dataform, GA4, Firebase, SQL, Python.
- Contactez-moi d’abord si votre configuration est non standard.
Langue:
Anglais
Expertise technique:
Google BigQuery
Secteur:
Analyse de données
FAQ
Traduction automatique
Aurez-vous besoin d’un accès billing/admin à mon projet GCP ?
Non, j’ai seulement besoin des rôles IAM spécifiques pour le travail à réaliser (par exemple Data Editor BigQuery, Job User). Je vous indiquerai exactement ce qu’il faut accorder.
Pouvez-vous garantir une réduction de coûts spécifique en % ?
Chaque environnement étant différent, je ne promets pas un chiffre avant d’avoir audité vos modèles de requêtes et schémas — mais la réduction des coûts est généralement la première chose que je recherche.
Travaillez-vous avec des outils en dehors de la stack Google (AWS, Snowflake, dbt) ?
Ma spécialisation principale est GCP/BigQuery, mais je suis à l’aise avec les patterns généraux d’ETL et d’orchestration. Contactez-moi si votre stack est mixte.
Pouvez-vous mettre en place cette solution pour qu’elle fonctionne sans que je touche à rien ?
Oui, les packages Standard et Premium incluent une orchestration planifiée pour que les pipelines s’exécutent automatiquement.

