À propos du poste
La fiabilité est une promesse que nous faisons à chaque utilisateur. Nos ingénieurs en fiabilité du site ont la responsabilité de l'accessibilité, de la performance et de la résilience de la plateforme HeroApply, ainsi que des outils permettant à chaque ingénieur de déployer avec confiance.
Vous travaillerez en collaboration avec des équipes pour concevoir en tenant compte des pannes, automatiser les tâches répétitives et rendre les incidents rares, courts et bien compris.
Ce que vous allez faire
- Vous êtes responsable de l'accessibilité, de la performance et de la capacité de la plateforme.
- Construire et maintenir les outils d'infrastructure, de déploiement et d'observabilité
- Diriger la réponse aux incidents et promouvoir des améliorations durables à partir de chaque incident
- Collaborer avec les équipes d'ingénierie sur une architecture fiable et sécurisée
- Automatiser les tâches opérationnelles et les documenter clairement
Ce que vous apportez
- Expérience étendue dans la gestion de systèmes en production à grande échelle
- Compétences solides en infrastructure, réseaux et plates-formes cloud
- Expertise en surveillance, alertes et gestion des incidents
- Une approche calme et méthodique lorsque les choses se dégradent
- Une tendance à l'automatisation et à une documentation claire
Nice to have
- Expérience avec l'infrastructure en code
- Sécurité ou conformité background.
- Antécédents de gestion d'un programme de fiabilité.

