À propos du poste
Nous recherchons un(e) Administrateur(trice) Support Infrastructure proactif(ve) pour rejoindre notre équipe. Dans ce rôle essentiel, vous serez la première ligne de défense de notre environnement serveur et cloud, en garantissant une haute disponibilité et des performances optimales pendant les heures de nuit.
Vous vous concentrerez dans un premier temps sur la surveillance et le traitement des alertes via PRTG, la réalisation de contrôles de l’état de santé des serveurs Windows/Linux, ainsi que le support de nos environnements Azure et Microsoft Entra. À mesure que le poste évoluera, vous prendrez en charge la gestion des correctifs serveurs et des opérations d’infrastructure avancées.
Principales responsabilités
- Surveillance et remédiation : Surveiller le tableau de bord PRTG, valider les alertes et exécuter les procédures documentées afin de résoudre rapidement les incidents.
- Dépannage : Effectuer une analyse des causes profondes des problèmes liés à Windows Server, notamment le processeur, la mémoire, les services et l’Observateur d’événements, ainsi que des tâches d’administration Linux de base.
- Support cloud et identité : Assurer le suivi de l’état des machines virtuelles Azure et de leur réseau, et surveiller les journaux de connexion Microsoft Entra afin d’identifier les problèmes d’authentification.
- Gestion des incidents : Transmettre les incidents complexes nécessitant des connaissances spécialisées, l’intervention d’un fournisseur ou des modifications en production, tout en documentant l’ensemble des actions réalisées.
- Maintenance : Participer aux activités de maintenance nocturne et, à terme, exécuter les procédures approuvées de déploiement des correctifs sur Windows et Linux.
- Documentation : Tenir à jour des notes détaillées sur les incidents, rédiger des synthèses de passation entre équipes et contribuer à l’amélioration des articles de connaissance et des procédures opérationnelles.
Compétences techniques requises
- Windows Server : Solides compétences en dépannage à l’aide de l’Observateur d’événements, des Services, du Gestionnaire des tâches et de PowerShell pour résoudre les problèmes de performance et de services.
- Administration Linux : Maîtrise de base de la ligne de commande pour vérifier l’utilisation du processeur, de la mémoire et de l’espace disque, consulter les journaux et utiliser SSH.
- Supervision avec PRTG : Expérience des outils de supervision d’infrastructure et capacité à distinguer les alertes informatives, les avertissements et les alertes critiques.
- Microsoft Azure : Connaissance des machines virtuelles, des groupes de ressources, des réseaux, notamment les VNET et NSG, ainsi que d’Azure Monitor.
- Microsoft Entra, anciennement Azure AD : Connaissance de la gestion des utilisateurs et des groupes, des journaux d’authentification, de l’authentification multifacteur et de l’accès conditionnel.
Expérience souhaitée
- Expérience des outils de gestion des correctifs en entreprise, tels qu’Azure Update Manager, WSUS ou MECM/SCCM.
- Compréhension de la validation des sauvegardes et des considérations liées à la restauration.
- Connaissance des environnements virtualisés, notamment VMware et Hyper-V.
Exigences opérationnelles
- Disponibilité obligatoire pour travailler selon un horaire de nuit régulier.
- Excellentes compétences en communication écrite pour la rédaction des notes d’incident et des comptes rendus de passation.
- Capacité à hiérarchiser les alertes en fonction de leur impact sur l’activité et à respecter rigoureusement les protocoles de sécurité et de conformité.
Pourquoi nous rejoindre ?
- Évolution professionnelle : Le poste commence par des activités de supervision et évolue vers la gestion des correctifs, la responsabilité de l’infrastructure et l’amélioration continue.
- Impact essentiel : Vous contribuerez directement à la stabilité et à la sécurité de notre infrastructure mondiale.
Critères d’évaluation
Les candidats idéaux devront démontrer leur capacité à :
- Dépanner un serveur Windows présentant une utilisation élevée du processeur ou un espace disque insuffisant.
- Analyser une alerte PRTG et déterminer l’action appropriée.
- Faire la distinction entre un problème lié à une ressource Azure et un problème lié au système d’exploitation invité.
- Expliquer une procédure sécurisée de déploiement des correctifs, depuis les vérifications préalables jusqu’à la validation après intervention.
- Rédiger une synthèse de passation claire et concise.
Rejoignez notre équipe et contribuez à un environnement collaboratif et innovant, dans lequel vos idées peuvent réellement faire la différence.
Nous serons heureux de recevoir votre candidature.