MISSIONS PRINCIPALES
Infrastructure as Code
Déployer les infrastructures via IaC sur tous les environnements (dev/staging/prod)
Créer, tester et livrer des templates Terraform réutilisables aux équipes Ops
Maintenir et faire évoluer les modules GCP (VPC, GKE, IAM, Cloud Storage, Secret Manager)
Réseau & Sécurité Opérationnelle
Gérer l'exposition internet, le whitelisting d'URL, l'ouverture de flux et les network policies Kubernetes
Renouveler les certificats d'infrastructure et appliquer les habilitations IAM
Gérer les vulnérabilités via CloudGuard (CSPM) et Sapiens ? suivi du cycle de remédiation
Observabilité & Monitoring
Installer et configurer Dynatrace : agents/OneAgent, dashboards, SLOs, alertes et consignes de pilotage associées
Déployer les espaces de log management et les dashboards d'observabilité
Contribuer au monitoring Cloud Logging/Cloud Monitoring en complément
Exploitation & Run
Assurer les MEP applicatives via GitOps (ArgoCD probable) et coordonner avec les équipes de développement
Gérer les incidents, problèmes et changements selon les processus ITIL (CAB, P1/P2/P3)
Assurer les sauvegardes (règles, conformité, restauration) et les accès sécurisés aux bases de données
Créer et administrer les comptes et projets GCP
Assurer le support N1 et N2 aux déploiements infrastructure et applicatif
Automatisation
Automatiser les gestes d'administration récurrents (Python, Bash, Terraform ou Ansible selon les cas)
Automatiser les tests de bon fonctionnement post-déploiement
Profil candidat:
PROFIL RECHERCHÉ
5 à 9 ans en ingénierie cloud/infrastructure, dont au moins 3 ans sur GCP en production
Expérience confirmée sur Kubernetes en exploitation (network policies, RBAC, troubleshooting, gestion des ressources)
Expérience en régie dans un grand groupe avec des processus ITIL formalisés
Expérience Dynatrace en installation et configuration (agents, dashboards, alertes)
Profil polyvalent assumé : un spécialiste d'un seul domaine ne couvre pas l'ensemble du périmètre
COMPÉTENCES REQUISES
GCP (+++) : IAM (service accounts, workload identity, policies, bindings), réseau GCP (VPC, firewall rules, Cloud NAT, Load Balancers, Cloud DNS), GKE (cluster management, node pools, network policies), Cloud Storage/Cloud SQL, Certificate Manager, Secret Manager, Cloud Logging/Monitoring ? administration en production réelle
Kubernetes (+++) : Gestion opérationnelle en production (deployments, services, ingress, HPA, PDB), network policies, RBAC, troubleshooting avancé (pods en échec, ressources insuffisantes, networking), GitOps via ArgoCD ou Flux
Terraform / IaC (++) : Création de modules et templates réutilisables pour GCP, gestion du state, workspaces, tests avant livraison aux Ops
Dynatrace (++) : Installation des agents, configuration des dashboards et SLOs, création des alertes avec consignes de pilotage, espaces de log management ? configuration complète, pas juste utilisation
CloudGuard / Sécurité Cloud (++) : Checkpoint CloudGuard CSPM : gestion de la posture de sécurité, détection et suivi des vulnérabilités, cycle de remédiation ; IAM GCP : principe du moindre privilège, audit des accès
CI/CD & GitOps (++) : ArgoCD ou Flux pour les MEP GitOps multi-environnements, GitLab CI ou Cloud Build pour les pipelines
ITIL (+) : Gestion des incidents (P1/P2/P3), processus CAB, changements formalisés en grand groupe