Les missions du poste
Le besoinNous renforçons notre équipe Opérations et cherchons un·e SRE expérimenté·e pour nous accompagner sur des sujets clés : fiabilité des systèmes, gestion des incidents et automatisation des opérations.Missions principales : Garantir la disponibilité, la performance et la scalabilité de la plateformeGérer les incidents de bout en bout (analyse des causes racines, correctifs, prévention)Améliorer l'observabilité et la qualité de serviceAutomatiser les opérations et le support (software / IA pour Ops)Collaborer étroitement avec les équipes dev, devops et sécuritéStack & environnement : GCP, Kubernetes, Linux / Python / Terraform / DatadogGitHub / GitHub ActionsRéseaux, sécurité (WAF, DDoS)
Le profil recherché
Profil recherchéProfil recherché : Solide expérience en production & gestion d'incidentsÀ l'aise dans des environnements critiques et orientés clientCapacité à communiquer clairement, y compris en situation de stress
Compétences requises
- Python
- Kubernetes
- Terraform
- Git
- Google cloud platform
- Linux
- Analyse des causes