Administrateur(trice), Systèmes de sauvegarde

Sommaire du poste

L’Administrateur(trice) des systèmes de sauvegarde est responsable de l’administration, de la surveillance et de l’amélioration continue des services de sauvegarde et de restauration de niveau entreprise de l’organisation. Cette personne agit à titre d’expert(e) principal(e) de la plateforme Commvault et veille à l’intégrité, à la disponibilité et à la capacité de récupération des données critiques de l’entreprise réparties sur environ 700 serveurs et charges de travail. En plus de Commvault, le titulaire du poste supervise les opérations de sauvegarde réalisées à l’aide des solutions Rubrik et Google Cloud Backup & Disaster Recovery, et coordonne les tests réguliers de récupération avec les équipes d’infrastructure, d’applications, de bases de données et de services infonuagiques.

Responsabilités

Administration de Commvault

  • Agir à titre d’administrateur(trice) principal(e) et d’expert(e) de référence pour l’environnement de sauvegarde Commvault.
  • Gérer, surveiller et maintenir les politiques de sauvegarde, les calendriers d’exécution, les paramètres de conservation et les configurations de récupération de Commvault.
  • Analyser et résoudre les échecs de sauvegarde, les problèmes de performance et les incidents de récupération liés à Commvault.
  • Effectuer les activités courantes de maintenance, les mises à niveau, l’application de correctifs et les revues de configuration de la plateforme Commvault.
  • S’assurer que les sauvegardes Commvault sont exécutées avec succès et qu’elles répondent aux exigences de récupération établies.

Exploitation des sauvegardes d’entreprise

  • Gérer et soutenir les services de sauvegarde d’entreprise utilisant Commvault, Rubrik et Google Cloud Backup & Disaster Recovery.
  • Surveiller les opérations quotidiennes de sauvegarde et traiter rapidement les échecs ou les exceptions.
  • Valider l’intégrité des sauvegardes et s’assurer que les objectifs de reprise, notamment les RPO (objectif de point de reprise) et RTO (objectif de temps de reprise), sont respectés.
  • Maintenir à jour la documentation des sauvegardes, les procédures opérationnelles et les guides d’exécution de reprise (runbooks).
  • Produire des rapports opérationnels sur les taux de réussite des sauvegardes, les échecs, la capacité et les résultats des tests de récupération.

Tests de restauration et reprise après sinistre

  • Planifier, coordonner et exécuter les activités régulières de tests de restauration et de récupération.
  • Collaborer avec les équipes d’infrastructure, d’applications, de bases de données et de services infonuagiques afin de valider la capacité de récupération des systèmes critiques.
  • Documenter les résultats des tests de restauration, les problèmes identifiés et les mesures correctives requises.
  • Soutenir les exercices de reprise après sinistre, les audits et les activités liées à la conformité.

Amélioration continue

  • Identifier les occasions d’améliorer la fiabilité des sauvegardes, l’automatisation, la surveillance et l’efficacité opérationnelle.
  • Recommander des améliorations aux processus, aux normes et aux configurations des plateformes de sauvegarde.
  • Participer aux projets d’infrastructure et d’infonuagique nécessitant l’intégration de solutions de sauvegarde et de récupération.

Exigences du poste

  • Minimum de cinq (5) années d’expérience dans l’administration de solutions de sauvegarde et de récupération de niveau entreprise;
  • Solide expérience pratique de l’administration, du dépannage et des opérations de récupération avec Commvault;
  • Expérience dans le soutien d’environnements de sauvegarde d’entreprise protégeant des charges de travail critiques pour les activités de l’organisation;
  • Une expérience avec Rubrik et des solutions de sauvegarde infonuagiques telles que Google Cloud Backup & Disaster Recovery constitue un atout;
  • Excellente compréhension des meilleures pratiques en matière de sauvegarde, de conservation des données, de reprise après sinistre et de protection des données;
  • Expérience du soutien d’environnements Windows, Linux, virtualisés et hébergés dans le nuage.
  • Solides compétences en analyse, en dépannage et en documentation; et
  • Excellentes aptitudes en communication et en collaboration, avec la capacité de coordonner les activités de tests de récupération et de reprise après sinistre auprès de multiples équipes. 

Nous vous remercions de votre intérêt pour Dollarama. Seuls les candidats sélectionnés pour une entrevue seront contactés par notre équipe de recrutement.