Contexte
Dans le cadre de l'évolution de ses plateformes numériques, notre client recherche un Ingénieur SRE Senior pour renforcer la fiabilité, la disponibilité et la résilience de ses services critiques. Le consultant intégrera une équipe transverse intervenant sur des environnements de production à forte disponibilité (24/7).
Missions principales
Garantir la disponibilité et la résilience des plateformes.
Automatiser les processus d'exploitation et de déploiement.
Définir et mettre en ?uvre les standards SRE.
Industrialiser les pratiques DevOps.
Développer et maintenir les plateformes d'observabilité.
Superviser les infrastructures et applications critiques.
Mettre en place les indicateurs SLI/SLO/SLA et réduire le MTTR.
Produire la documentation technique, les dashboards Grafana, les runbooks et les rapports d'exploitation.
Profil candidat:
Compétences techniques requises
SRE : Environnements critiques, haute disponibilité, SLI/SLO/SLA, analyse de performances.
DevOps : GitLab CI/CD, GitHub Actions ou Jenkins, Docker, Kubernetes, Helm, Terraform, Ansible.
Observabilité : Grafana, Prometheus, Loki, Tempo (expertise avancée).
Systèmes : Linux (RedHat, CentOS, Rocky Linux), TCP/IP, sécurité des infrastructures.
Langages : Python, Bash (Go apprécié).
Profil recherché
Ingénieur SRE Senior / Expert Technique.
6 ans d'expérience minimum.
Autonomie, rigueur, sens de l'analyse, qualités rédactionnelles et bon relationnel.
Participation à des astreintes pour assurer la continuité de service 24/7.