SRE – Kubernetes & Rancher (IT)
Dans le cadre du renforcement d?une équipe d?exploitation, nous recherchons un Ingénieur d?exploitation / SRE ? SYSOPS chargé d?assurer la fiabilité, la performance et la disponibilité des applications et infrastructures en production. Vous intervenez notamment sur : Le maintien en conditions opérationnelles (MCO) des systèmes, applications et flux. La surveillance et l?observabilité des environnements afin d?anticiper et résoudre les incidents. La gestion des environnements de recette, préproduction et production. L?analyse des incidents, la recherche des causes racines et la mise en ?uvre d?actions correctives. L?automatisation des opérations et des déploiements via CI/CD, Git
Ops et Infrastructure as Code. L?administration et la supervision d?environnements Kubernetes / Rancher. L?optimisation des performances, de la résilience et de la haute disponibilité. La gestion et la supervision d?infrastructures Cloud. La mise en place et le maintien de la documentation et des procédures d?exploitation. La collaboration avec les équipes développement, infrastructure et production dans une démarche SRE / Dev
Ops. Profil candidat: Très bonne maîtrise des environnements Linux / Windows. Kubernetes : déploiement, namespaces, services, ingress, volumes, autoscaling, rolling updates. Rancher / RKE2 : administration de clusters, gestion multi-clusters, projets, utilisateurs et rôles. Automatisation / Ia
C : Ansible, Terraform, Helm, Shell. CI/CD : Git
Lab CI, Nexus, Git
Ops. Cloud / virtualisation : VMware NSX, Open
Stack, Outscale. Monitoring : Prometheus, Grafana, Zabbix. Logging : Loki, ELK. Connaissances réseau, stockage Kubernetes (PV/PVC, CSI) et plateformes J2EE ? JBoss/Tomcat. Au-delà de la technique, nous recherchons une personne autonome, rigoureuse, réactive, capable de gérer des incidents complexes, de travailler sous pression et de communiquer avec différents interlocuteurs. Une culture ITIL, Dev
Ops et amélioration continue est appréciée. Des astreintes peuvent être à prévoir.