Description du posteNous recherchons pour le compte de notre client dans le domaine des paiements, un(e) Ingénieur SRE Senior / Expert DevOps & Observabilité.
Environnement techniqueGitLab CI/CD, GitHub Actions, Jenkins, Docker, Kubernetes, Helm, Terraform, Ansible, Grafana, Loki, Prometheus, Tempo, Linux (RedHat, CentOS, Rocky Linux), TCP/IP, Python, Bash, Go
ContexteDans un contexte de modernisation de ses plateformes numériques et de renforcement de la fiabilité de ses services critiques, notre client renforce son équipe transverse d'intégration rattachée à la direction Fabrication, sur le périmètre Autorisation. La personne recrutée rejoindra un environnement de production à très forte disponibilité (24/7) et travaillera en lien étroit avec les équipes de développement et d'exploitation pour fiabiliser et industrialiser les pratiques d'ingénierie SRE.
MissionsPiloter la disponibilité et la résilience des plateformes de production
Déployer l'automatisation des opérations d'exploitation et de mise en production
Contribuer à la définition et au déploiement des standards SRE au sein des équipes
Accompagner l'industrialisation des pratiques DevOps
Concevoir et faire évoluer les solutions d'observabilité
Assurer la supervision des infrastructures et applications sensibles
Travailler à la réduction des délais de résolution d'incidents (MTTR)
Construire et suivre des indicateurs SLI/SLO/SLA
Participer à un dispositif d'astreinte pour garantir la continuité de service 24/7
Compétences attenduesSRE, DevOps, Observabilité, SLI/SLO/SLA, CI/CD, Docker, Kubernetes, Helm, Terraform, Ansible, Grafana, Loki, Prometheus, Tempo, Linux, Sécurité infrastructure, Python, Bash, Go, MTTR, Astreinte 24/7
Profil candidat:
Description du posteNous recherchons pour le compte de notre client dans le domaine des paiements, un(e) Ingénieur SRE Senior / Expert DevOps & Observabilité.
Environnement techniqueGitLab CI/CD, GitHub Actions, Jenkins, Docker, Kubernetes, Helm, Terraform, Ansible, Grafana, Loki, Prometheus, Tempo, Linux (RedHat, CentOS, Rocky Linux), TCP/IP, Python, Bash, Go
ContexteDans un contexte de modernisation de ses plateformes numériques et de renforcement de la fiabilité de ses services critiques, notre client renforce son équipe transverse d'intégration rattachée à la direction Fabrication, sur le périmètre Autorisation. La personne recrutée rejoindra un environnement de production à très forte disponibilité (24/7) et travaillera en lien étroit avec les équipes de développement et d'exploitation pour fiabiliser et industrialiser les pratiques d'ingénierie SRE.
MissionsPiloter la disponibilité et la résilience des plateformes de production
Déployer l'automatisation des opérations d'exploitation et de mise en production
Contribuer à la définition et au déploiement des standards SRE au sein des équipes
Accompagner l'industrialisation des pratiques DevOps
Concevoir et faire évoluer les solutions d'observabilité
Assurer la supervision des infrastructures et applications sensibles
Travailler à la réduction des délais de résolution d'incidents (MTTR)
Construire et suivre des indicateurs SLI/SLO/SLA
Participer à un dispositif d'astreinte pour garantir la continuité de service 24/7
Compétences attenduesSRE, DevOps, Observabilité, SLI/SLO/SLA, CI/CD, Docker, Kubernetes, Helm, Terraform, Ansible, Grafana, Loki, Prometheus, Tempo, Linux, Sécurité infrastructure, Python, Bash, Go, MTTR, Astreinte 24/7