Et si nous cassions quelque chose ? Au lieu de toujours construire et réparer. Quelle monotonie mortelle.
Cassons de manière à ce qu'il n'y ait aucune conséquence pour nous — et même à être félicités pour ce désordre. Et ensuite, reconstruisons tout — mais cette fois de façon à ce que ce soit nettement meilleur, plus résilient et plus rapide.
Et cassons encore une fois.
Pensez-vous que c'est un concours pour utiliser l'outil le plus secret de notre astronautique — le Big Russian Space Hammer ?
Non, c'est un intensive en ligne SRE. Il se trouve que chaque cours n'est jamais semblable au précédent. Tout simplement parce qu'on ne peut jamais deviner ce qui pourrait tomber, casser, ralentir, bugger dans un énorme système complexe auquel des milliers et des milliers d'utilisateurs se connectent chaque seconde, et dont le public total compte plusieurs millions, et qui peut détruire l'humeur de l'équipe SRE de garde de centaines de manières.
En décembre, nous organiserons un nouveau .

Faisons une petite rétrospective. Souvenez-vous, il y a quelques années à peine, les RH participaien à des courses pour voir qui pourrait attirer le plus d'ingénieurs DevOps dans leur entreprise. Le prix a changé. Maintenant, ils surveillent l'environnement comme un système de surveillance "Pantzir-S1", à la recherche d'ingénieurs SRE. J'en ai parlé dans l'article «», de la vie d'un ingénieur SRE chez Google, et comment même une telle corporation ressent une pénurie d'experts SRE.
Lors de l'intensive en ligne en décembre pendant trois jours, de 10h00 à 19h00, vous apprendrez à garantir la rapidité, la résilience et la disponibilité des sites dans des conditions de ressources limitées, à éliminer les incidents informatiques et à réaliser des retours d'expérience pour éviter que les problèmes ne se reproduisent.
Intervenants du cours :
Ivan Kruglov. Ingénieur logiciel senior chez Databricks. Fort d'une expérience dans des entreprises de grande envergure en matière de livraison et de traitement distribué de messages, BigData et web-stack, recherche, création de clouds internes, service mesh.
Pavel Selivanov. Ingénieur DevOps senior chez Mail.ru Cloud Solutions. Il a à son actif des dizaines d'infrastructures construites et des centaines de pipelines CI/CD écrits. Administrateur Kubernetes certifié. Auteur de plusieurs cours sur Kubernetes et DevOps. Conférencier régulier lors de conférences IT en Russie et à l'international.
Tout se déroulera de manière intense, imprévisible et pratique. Vous allez construire, casser et réparer — parfois dans des séquences très variées.
Construire : Vous allez formuler des indicateurs SLO, SLI, SLA pour un site composé de plusieurs microservices ; développer l'architecture et l'infrastructure nécessaires ; assembler, tester et déployer le site ; configurer la surveillance et les alertes.
Casser : Vous examinerez les facteurs internes et externes qui dégradent les SLO : erreurs des développeurs, pannes d'infrastructure, afflux de visiteurs, attaques DoS. Vous apprendrez à comprendre la résilience, le budget d'erreurs, les pratiques de test, la gestion des interruptions et la charge opérationnelle.
Réparer : Vous serez formé à organiser rapidement et efficacement le travail d'une équipe pour résoudre une crise dans les meilleurs délais : impliquer des collègues, informer les parties prenantes, établir des priorités.
Étudier : Vous pourrez aborder le site du point de vue de SRE. Analyser les incidents. Déterminer comment éviter leur récurrence future : améliorer la surveillance, changer l'architecture, les approches de développement et d'exploitation, les règlements. Automatiser les processus.
écape les conditions réelles — le temps pour restaurer la fonctionnalité du service sera très limité. Comme dans la vraie vie, comme dans une situation de travail réelle.
Pour connaître les conditions du cours SRE ainsi que pour étudier le programme complet, vous pouvez consulter .
L'intensif en ligne est prévu pour décembre 2020. Pour ceux qui paieront leur participation à l'avance, nous avons préparé une remise.
Prêt pour un apprentissage intense, des défis atypiques et des pannes soudaines ?
Simple — il n'y aura pas. Il y aura une croissance professionnelle.
Source : habr.com
