Je vais concevoir et construire votre architecture de data lake sur AWS

Certaines informations ont été traduites automatiquement.

Inde

Je parle Hindi, Anglais

Ingénieur de données senior

Je suis un ingénieur de données senior avec plus de 3 ans d’expérience dans la création et la gestion de solutions d’ingénierie de données basées sur AWS. Je me spécialise dans les architectures de da...
À propos de ce service

Vous avez du mal avec un data lake lent, désordonné ou inexistant sur AWS ? J’aide les entreprises à concevoir et à construire des architectures de data lake évolutives et prêtes pour la production en utilisant S3, Glue, EMR et Athena, la même stack que j’utilise quotidiennement pour la gestion de données d’un client du secteur bancaire/financier avec un data lake de plusieurs téraoctets.

Que vous partiez de zéro ou que vous ayez besoin de réparer une configuration existante, je peux vous aider avec :

Conception d’architecture de data lake (couches d’analyse en bronze)

Configuration du catalogues Glue AWS et accès inter-comptes

Optimisation des requêtes Athena/Presto

Conception de pipelines de données S3/Parquet à grande échelle

Recommandations pour les pipelines ETL utilisant Spark

J’ai conçu des pipelines traitant plus de 100 Go de données avec des cycles de rafraîchissement bi-hebdomadaires, résolu des problèmes de catalogues Glue inter-comptes et converti des logiques SQL Server legacy en requêtes compatibles Athena, ce qui représente des problèmes réels de production, pas du travail de tutoriel.

Discutons de votre configuration de données et je vous aiderai à construire quelque chose qui évolue.

Langue:

Anglais

Hindi

Expertise technique:

Apache Spark

Amazon S3

Autres

Expertise:

Pipelines de data

Entreposage de data

Secteur:

Analyse de données