Operateur Monitoring
Enregistrez cette offre et organisez votre recherche
Créez un compte gratuit pour enregistrer des offres d'emploi, créer des alertes et revenir à cette liste depuis votre tableau de bord.
1. Présentation de l’ETNIC
L’ETNIC (Entreprise pour les Technologies de l’Information et de la Communication) est l’opérateur informatique de la Fédération Wallonie-Bruxelles. Organisme d’intérêt public, l’ETNIC a pour mission de concevoir, développer, maintenir et faire évoluer les systèmes d’information et les infrastructures technologiques au service des administrations et établissements de la FWB.
Acteur central de la transformation numérique du secteur public francophone belge, l’ETNIC intervient dans des domaines variés tels que :
- La gestion des infrastructures IT (réseaux, sécurité, data centers, cloud),
- Le développement d’applications métiers sur mesure,
- L’accompagnement des projets digitaux (analyse fonctionnelle, UX/UI, gestion de projet),
- La cybersécurité et la protection des données,
- Le support utilisateurs et la formation.
Dans un souci constant d’innovation, de performance et de service public, l’ETNIC collabore régulièrement avec des partenaires externes pour renforcer ses équipes à travers des missions de consultance IT. Ces collaborations s’inscrivent dans un cadre éthique, professionnel et orienté vers la qualité et l’impact concret des solutions livrées.
2. Mission
Zabbix - Administration et exploitation
- Maîtriser l'ensemble de l'environnement Zabbix : création et maintenance de dashboards, maps réseau, triggers, items et templates Configurer et ajuster les seuils d'alerte (triggers) selon les besoins métier et techniques, y compris via macros utilisateur et triggers dépendants pour limiter le bruit
- Créer et maintenir des templates de supervision réutilisables (items, macros, LLD, low-level discovery)
- Concevoir et maintenir des items de type Zabbix Agent, SNMP, JMX, HTTP Agent et External Checks selon les cas d'usage
- Développer des scripts de discovery personnalisés (LLD) pour l'auto-découverte d'équipements et de services
- Diagnostiquer les faux positifs, alertes bruyantes et anomalies de collecte (proxy, pollers, timeouts) en encore avec les équipes techniques sous la supervision du responsable
- Assurer le suivi quotidien des alertes actives et leur qualification (incident réel vs bruit)
- Configurer et maintenir les intégrations Zabbix ↔ ServiceNow (remontée automatique d'incidents) et Zabbix ↔ outils de notification
- Administrer l'architecture Zabbix distribuée (proxies, serveurs, haute disponibilité) et en assurer la performance
- Participer à l'évolution de l'architecture de supervision (proxies, intégrations SNMP v2/v3, API VMware, NetFlow, etc.)
- Réaliser des analyses de causes racines (RCA) sur des incidents complexes multi-couches (réseau, système, application, stockage) à la demande des équipes techniques
- Maîtriser le module Services de Zabbix (Business Service Monitoring) : construction d'arbres de services hiérarchiques, agrégation d'états (SLA/SLO) à partir des triggers, calcul et suivi du taux de disponibilité par service métier
- Modéliser des services applicatifs de bout en bout en associant les composants techniques (hosts, triggers) aux services métier concernés, pour une vision orientée utilisateur/business plutôt que purement infrastructure
- Configurer les problem tags et les règles de propagation d'état pour un mapping fidèle entre incidents techniques et impact sur les services
- Exploiter les rapports de SLA générés par le module Services pour alimenter le reporting mensuel et les revues de disponibilité
Oh Dear - Surveillance des sites web
- Mettre en place et maintenir la surveillance technique des sites web sur Oh Dear (disponibilité, certificats SSL, performance, uptime, broken links, mixed content)
- Configurer les alertes (email, webhooks, intégrations tierces) et vérifier quotidiennement l'état des sites supervisés
- Exploiter l'API REST d'Oh Dear pour l'extraction de données et l'intégration avec les outils de reporting (Power BI, un plus)
- Assurer le suivi des incidents détectés et leur remontée aux équipes concernées, avec analyse d'impact
ServiceNow - Gestion des tickets et incidents
- Vérifier quotidiennement les incidents créés dans ServiceNow liés au monitoring et en assurer la qualification technique
- Prendre en charge l'ensemble des demandes des équipes IT arrivant via notre catalogue de demande dans ServiceNow et par email
- Qualifier, prioriser (selon impact/urgence) et traiter les demandes liées au monitoring reçues via ServiceNow ou par email
- Contribuer à la fiabilité de la CMDB en lien avec les processus de découverte (VMware, réseau) et la résolution des conflits d'identification
- Assurer un suivi rigoureux jusqu'à la clôture des tickets, avec documentation des actions menées
Observabilité
- Par