Je suis ingénieur Site Reliability/DevOps avec plus de 4 ans d'expérience pratique dans la construction d'infrastructures évolutives sans interruption à 3h du matin.
Ce que j'ai réellement construit en production :
- Migration AWS sans interruption (changement d'Elastic IP entre comptes, délégation DNS Route53, reconfiguration NLB) avec automatisation du rollback
- pipelines CI/CD utilisant CDK/CodePipeline et GitHub Actions avec scan de sécurité automatisé
- clusters EKS avec stockage FSx et récupération après sinistre, réduisant le temps d'arrêt de 90%
- surveillance CloudWatch/Prometheus couvrant plus de 15 modes de défaillance avec journalisation structurée et alertes multi-périodes
- infrastructure provisionnée avec Terraform pour une intégration sécurisée et reproductible
- automatisation personnalisée en Go et Python pour l'orchestration d'infra (par exemple, une couche proxy SFTP personnalisée)
Ce que j'apporte de mes propres systèmes (construits et gérés de manière indépendante) :
- plateformes Kubernetes auto-réparatrices avec GitOps (ArgoCD), policy-as-code (Kyverno) et chaos engineering (AWS FIS) testées contre un SLA de récupération de 10 minutes
- détection de sécurité en temps réel avec Falco et réponse aux incidents automatisée et hiérarchisée
- un opérateur Kubernetes from scratch (Go, CRDs personnalisés, controller-runtime) pour la gestion de flotte
- Multi-cl