En quelques motsCherry Pick est à la recherche d'un Application Observability Engineer(H/F), pour le compte de l'un de ses clients qui opère dans le domaine de la High-tech.
Description? Contexte de la missionAu sein d'un groupe spécialisé dans les logiciels et services pour les professionnels du patrimoine et de la finance, vous rejoignez l'équipe de transformation sous la direction de l'Application Observability Lead et du Head of IT Transformation.
Dans le cadre de l'harmonisation de son paysage technique (regroupant près de 300 ingénieurs répartis dans plus de 20 équipes), l'entreprise déploie son socle d'observabilité autour de Grafana Cloud (Loki, Tempo, Faro, K6, OpenTelemetry, Prometheus). Après une phase pilote sur la partie outillage, l'enjeu principal consiste désormais à déployer ce socle sur une dizaine d'équipes (dont des applications critiques) tout en instaurant une vraie culture de l'observabilité et le modèle « you build it, you run it ».
Pour porter ce projet d'envergure, nous recherchons un(e) Application Observability Engineer / Tech Lead Observabilité (H/F). Votre mission combinera le déploiement technique de la plateforme et l'accompagnement des équipes dans la structuration de leurs processus de gestion d'incidents.
? Missions principales & Rôle1. Standardisation & Déploiement Grafana Cloud :
Définir et déployer les standards d'observabilité sur Grafana Cloud : dashboards, monitoring applicatif (Kubernetes / EKS, VMs), supervision des bases de données (RDS), définition des SLOs/SLIs, règles d'alerting, synthetic monitoring, collecte et traitement des logs/traces.
Adapter la stack aux besoins spécifiques des applications tout en garantissant la cohérence globale avec les normes de l'entreprise.
Collaborer avec les équipes d'infrastructure Cloud pour assurer la collecte performante des métriques, traces et logs via les collecteurs (OpenTelemetry, Prometheus).
2. Coaching, Accompagnement & Culture DevOps :
Réaliser l'état des lieux des pratiques et outils existants équipe par équipe, puis définir un plan de migration structuré.
Accompagner progressivement une dizaine d'équipes applicatives (cadrage, configuration, tests, suivi).
Former et sensibiliser les équipes d'ingénierie aux bonnes pratiques d'observabilité pour ancrer la responsabilité du suivi en production (« you build it, you run it »).
3. Structuration des Processus de Gestion d'Incidents :
Accompagner la refonte des workflows de gestion d'incidents afin d'accélérer la détection et la résolution des anomalies avant tout impact utilisateur.
Faire évoluer le modèle de suivi et d'escalade des alertes entre la DSI et les équipes projets.
? ObjectifsPasser d'un monitoring subi à une observabilité proactive intégrée au cycle de vie applicatif.
Déployer et généraliser le socle Grafana Cloud auprès d'une dizaine d'équipes clés.
Responsabiliser les équipes projets sur le suivi de leurs applications en production et optimiser les délais de résolution d'incidents (MTTR).
Profil candidat:
?? Compétences requises?? Expertise Technique (Impérative & Production-ready)Grafana Cloud (Expertise "Hands-on") : Maîtrise approfondie de Grafana Cloud (SaaS) et de sa suite produit (Loki, Tempo, Faro, K6), issue d'au moins un déploiement significatif en environnement de production.
Collecte & Métriques : Solides compétences sur OpenTelemetry (OTel Collector) et Prometheus.
Cloud & Conteneurs : Maîtrise des architectures Cloud AWS (EC2, EKS, RDS...) et de l'écosystème Kubernetes.
Stack Additionnelle (Appréciée) : Connaissances en ElasticSearch et Terraform (IaC pour provisionner l'observabilité).
?? Expertise Métier & ProductionGestion d'Incidents & Run (MUST) : Expérience éprouvée du fonctionnement d'applications complexes en production, des processus ITSM/Incidents, du routage des alertes et du suivi de disponibilité (SLO/SLA).
? Profil recherchéExpérience : Au moins 5 ans d'expérience dans l'IT sur des rôles de Tech Lead, Ingénieur DevOps/SRE ou Chef de Projet Technique, avec une spécialisation concrète sur l'observabilité.
Soft Skills :
Capacité à embarquer & Pédagogie : Excellente communication pour faire adhérer les développeurs aux enjeux de production et véhiculer la culture DevOps/Observabilité.
Posture de Coach / Orienté Impact : Sens aigu du pragmatisme pour adapter la théorie aux réalités du terrain applicatif.
Force de proposition : Capacité à structurer des processus clairs dans un contexte d'organisation en transformation.