Expert Aws Production - Sre H/F - Anderson RH
- Tours - 37
- Indépendant
- Télétravail accepté
- Anderson RH
Les missions du poste
Le besoin
Contexte
Mission au sein d'un grand environnement SI.
Intervention sur des infrastructures AWS critiques.
Forte dimension Production, RUN, Cloud, SRE et DevOps.
Environnement nécessitant un haut niveau de disponibilité, sécurité et résilience.
Missions
- Assurer le maintien en conditions opérationnelles des environnements AWS.
- Superviser la disponibilité, les performances et la capacité des infrastructures Cloud.
- Analyser et résoudre les incidents de production complexes.
- Réaliser les analyses de causes racines et piloter les actions correctives associées.
- Mettre en place et améliorer les dispositifs de monitoring, alerting et observabilité.
- Sécuriser et fiabiliser les architectures AWS existantes.
- Accompagner les mises en production et les déploiements.
- Automatiser les tâches d'exploitation et d'administration récurrentes.
- Industrialiser les environnements via l'Infrastructure as Code.
- Optimiser les performances et les coûts des ressources Cloud.
- Participer à l'amélioration des procédures et standards d'exploitation.
- Apporter une expertise technique aux équipes Infrastructure, DevOps, Sécurité et Développement.
- Contribuer aux problématiques de PRA/PCA, haute disponibilité et résilience.
Outils & Environnement
- AWS : EC2, S3, RDS, VPC, IAM, Lambda, ECS/EKS, Route 53, CloudFront
- Terraform / CloudFormation
- CloudWatch
- Grafana / Prometheus
- Docker
- Kubernetes / EKS
- GitLab CI / Jenkins / GitHub Actions
- Linux
- Python / Bash
Conditions de travail
- Lieu de la mission : Tours
- 2 jours de télétravail par semaine
- Date de démarrage : ASAP
- Mission de longue durée
- Anglais professionnel obligatoire
Le profil recherché
Profil recherché
- 10 ans minimum d'expérience sur des environnements AWS réellement exploités en production
- Excellente maîtrise d'AWS
- 8 ans minimum d'expérience en Production / RUN / SRE
- Gestion d'incidents complexes et troubleshooting
- Monitoring et observabilité
- Infrastructure as Code
- Automatisation et scripting
- Bonne maîtrise des environnements Linux
- Connaissance des problématiques de sécurité Cloud
- 8 ans minimum d'expérience sur des architectures à haute disponibilité
- Maîtrise des outils et technologies : EC2, S3, RDS, VPC, IAM, Lambda, ECS/EKS, Route 53, CloudFront, Terraform, CloudFormation, CloudWatch, Grafana, Prometheus, Docker, Kubernetes, GitLab CI, Jenkins, GitHub Actions, Python, Bash
- Certification AWS appréciée
- 8 ans minimum d'expérience en environnement fortement critique
- Connaissance des démarches SRE
- 8 ans minimum d'expérience sur des architectures multi-AZ / résilientes
- Bonne maîtrise des problématiques FinOps
- 8 ans minimum d'expérience sur des dispositifs PRA / PCA
- Forte capacité d'analyse
- Réactivité face aux incidents
- Autonomie
- Rigueur
- Prise de recul
- Sens du service
- Capacité à travailler avec plusieurs équipes techniques
- Force de proposition
- Culture de l'amélioration continue