Ingénieur SRE Storage & AIOps H/F/N
Au sein de votre équipe #OneTeam
Vos principales responsabilités
Garantir le maintien en condition opérationnelle (MCO), la haute disponibilité et la performance des infrastructures de stockage EFS et ZFS
Prendre en charge et résoudre les incidents (alertes, tickets clients) tout en menant des analyses de cause racine (post-mortems)
Concevoir, déployer et optimiser les outils de monitoring et de métrologie pour passer d'une gestion réactive à une approche proactive
Diffuser la culture DevOps ainsi que les bonnes pratiques de développement, d'automatisation et de collaboration au sein de l'équipe
Identifier, intégrer et faire grandir les cas d'usage de l'IA appliquée aux opérations (analyse prédictive des pannes, optimisation de la capacité, détection d'anomalies)
Traduire le potentiel de l'AIOps en outils concrets pour simplifier et automatiser les tâches répétitives de l'équipe
Mettre en place une approche Infrastructure as Code et industrialiser nos chaînes CI/CD
Votre futur impact
Dans 6 mois
Et dans 1 an
Compétences requises :
Vous maîtrisez parfaitement l'approche Infrastructure as Code (Terraform, Ansible, Salt, Puppet) et les chaînes de CI/CD (GitLab CI, GitHub Actions)
Vous disposez d'une expérience solide sur les suites d'observabilité (Grafana, Prometheus, Zabbix, OpenSearch, Graylog) pour la collecte de métriques, traces et la corrélation de logs
Vous maîtrisez les concepts AIOps (analyse prédictive, détection d'anomalies par ML, corrélation intelligente) ainsi que le Prompt Engineering et les assistants de génération de code Vous possédez une excellente connaissance des environnements Linux et/ou Cloud Native (Kubernetes, Docker)
Vous maîtrisez au moins un langage de script ou de développement orienté Ops et automatisation (Python, Go ou Bash avancé)
Vous êtes autonome et capable de travailler dans un environnement en évolution rapide
C'est un +
Copyright © 2026 Grabjobs Pte.Ltd. All Rights Reserved.