Dans un contexte de montée en charge rapide de notre réseau de capteurs radar, nous renforçons notre capacité d’exploitation afin de garantir un haut niveau de disponibilité, de fiabilité et de performance.
Notre système repose sur une architecture distribuée combinant :
capteurs radar terrain
infrastructures réseau et systèmes embarqués
backend de traitement et de supervision
composants cloud et on-premise
Les enjeux sont forts : continuité de service, qualité des données, réactivité face aux incidents, et structuration d’une exploitation encore en construction.
Vous intervenez comme référent technique exploitation, au cœur des opérations, avec une vision transverse du système.
Vous êtes impliqué à la fois dans la gestion opérationnelle et dans la structuration des pratiques d’exploitation.
Prise en charge des incidents complexes (N2/N3)
Analyse approfondie via logs, métriques, traces réseau
Identification des causes racines (RCA) et mise en œuvre de solutions durables
Coordination des actions correctives avec les équipes internes et partenaires
Suivi des incidents critiques jusqu’à résolution complète
Contribution à l’amélioration des outils de supervision (alerting, dashboards, corrélations)
Optimisation des seuils d’alerte pour limiter le bruit et améliorer la détection
Participation à la mise en place d’indicateurs de performance et de disponibilité
Formalisation et amélioration des procédures d’exploitation
Automatisation des tâches récurrentes (scripts, outils internes)
Contribution à la fiabilisation globale du système (réduction des incidents, amélioration de la résilience)
Participation aux retours d’expérience (post-mortem, plans d’action)
Interface entre exploitation, développement, plateforme et équipes radar
Contribution aux choix techniques ayant un impact sur l’exploitation
Accompagnement des équipes sur les problématiques opérationnelles
Participation aux phases de mise en production et de validation
Linux (administration système avancée)
Réseaux (TCP/IP, routage, diagnostic réseau)
Outils de supervision et de monitoring
Analyse de logs et métriques
Systèmes distribués et environnements hybrides
Scripting (Bash, Python ou équivalent)
Formation ingénieur ou équivalent
Expérience significative (5+ ans) en exploitation technique ou production
Expérience en environnements critiques ou fortement contraints (industrie, télécoms, défense, spatial…)
Capacité à investiguer des incidents complexes de bout en bout
Bonne compréhension des architectures systèmes et réseau
Autonomie, rigueur et sens des priorités
Capacité à prendre du recul et à structurer des pratiques
Bon relationnel, capacité à travailler en transverse
Anglais professionnel
Votre candidature a été envoyée avec succès !
Nous vous remercions de l'intérêt que vous portez à ce poste. Malheureusement, vous avez déjà postulé à cet emploi.
Copyright © 2026 Grabjobs Pte.Ltd. All Rights Reserved.