RÉSILIENCE / STOCKAGE ET OBSERVABILITÉ
La reprise fait partie de la conception.
Je considère les sauvegardes, la planification de reprise et la supervision comme des éléments liés de l’exploitation d’une infrastructure. Le stockage protège les données ; l’observabilité aide à comprendre les événements.
01 / SAUVEGARDE
Protéger l’état utile.
Mon environnement local comprend un Synology DS1618+ pour le stockage et les sauvegardes. Le principe de sauvegarde 3-2-1 constitue une base utile : conserver trois copies des données importantes, sur deux types de supports, dont une hors site. Les définitions d’infrastructure et les données applicatives ne se gèrent pas de la même façon : les premières décrivent la reconstruction, les secondes préservent l’état nécessaire.
02 / REPRISE
Planifier le retour au service.
Mon travail sur les services cloud chez Hong Kong Telecom comprenait la planification et l’exécution de reprises. Cette expérience guide mon approche des dépendances, des restaurations et de l’ordre de remise en service.
03 / SUPERVISION
Garder le système compréhensible.
J’utilise Grafana pour superviser l’infrastructure. Chez Crypto.com, j’ai participé à la supervision d’infrastructures blockchain L1 ; chez Pinax, je contribue à la supervision et à l’optimisation des opérations blockchain.
Relier le cloud à l’infrastructure locale
Mon travail actuel associe Terraform, les outils de conteneurs, le stockage local et Grafana. Les présentations de projets expliquent les systèmes que ces outils soutiennent.
Explorer les projets d’infrastructure