Intensif en ligne SRE : nous allons tout casser jusqu'à la base, puis nous réparerons, casserons encore quelques fois, et ensuite tout reconstruire

Et si nous cassions quelque chose ? Au lieu de toujours construire et réparer. Quelle monotonie mortelle.

Cassons de manière à ce qu'il n'y ait aucune conséquence pour nous — et même à être félicités pour ce désordre. Et ensuite, reconstruisons tout — mais cette fois de façon à ce que ce soit nettement meilleur, plus résilient et plus rapide.

Et cassons encore une fois.

Pensez-vous que c'est un concours pour utiliser l'outil le plus secret de notre astronautique — le Big Russian Space Hammer ?

Non, c'est un intensive en ligne SRE. Il se trouve que chaque cours Sleurm SRE n'est jamais semblable au précédent. Tout simplement parce qu'on ne peut jamais deviner ce qui pourrait tomber, casser, ralentir, bugger dans un énorme système complexe auquel des milliers et des milliers d'utilisateurs se connectent chaque seconde, et dont le public total compte plusieurs millions, et qui peut détruire l'humeur de l'équipe SRE de garde de centaines de manières.

En décembre, nous organiserons un nouveau intensive en SRE.

Intensif en ligne SRE : nous allons tout casser jusqu'à la base, puis nous réparerons, casserons encore quelques fois, et ensuite tout reconstruire

Faisons une petite rétrospective. Souvenez-vous, il y a quelques années à peine, les RH participaien à des courses pour voir qui pourrait attirer le plus d'ingénieurs DevOps dans leur entreprise. Le prix a changé. Maintenant, ils surveillent l'environnement comme un système de surveillance "Pantzir-S1", à la recherche d'ingénieurs SRE. J'en ai parlé dans l'article «Evgeny Varavva, développeur chez Google. Comment décrire Google en 5 mots», de la vie d'un ingénieur SRE chez Google, et comment même une telle corporation ressent une pénurie d'experts SRE.

Lors de l'intensive en ligne Sleurm SRE en décembre pendant trois jours, de 10h00 à 19h00, vous apprendrez à garantir la rapidité, la résilience et la disponibilité des sites dans des conditions de ressources limitées, à éliminer les incidents informatiques et à réaliser des retours d'expérience pour éviter que les problèmes ne se reproduisent.

Intervenants du cours :

Ivan Kruglov. Ingénieur logiciel senior chez Databricks. Fort d'une expérience dans des entreprises de grande envergure en matière de livraison et de traitement distribué de messages, BigData et web-stack, recherche, création de clouds internes, service mesh.

Pavel Selivanov. Ingénieur DevOps senior chez Mail.ru Cloud Solutions. Il a à son actif des dizaines d'infrastructures construites et des centaines de pipelines CI/CD écrits. Administrateur Kubernetes certifié. Auteur de plusieurs cours sur Kubernetes et DevOps. Conférencier régulier lors de conférences IT en Russie et à l'international.

Tout se déroulera de manière intense, imprévisible et pratique. Vous allez construire, casser et réparer — parfois dans des séquences très variées.

Construire : Vous allez formuler des indicateurs SLO, SLI, SLA pour un site composé de plusieurs microservices ; développer l'architecture et l'infrastructure nécessaires ; assembler, tester et déployer le site ; configurer la surveillance et les alertes.

Casser : Vous examinerez les facteurs internes et externes qui dégradent les SLO : erreurs des développeurs, pannes d'infrastructure, afflux de visiteurs, attaques DoS. Vous apprendrez à comprendre la résilience, le budget d'erreurs, les pratiques de test, la gestion des interruptions et la charge opérationnelle.

Réparer : Vous serez formé à organiser rapidement et efficacement le travail d'une équipe pour résoudre une crise dans les meilleurs délais : impliquer des collègues, informer les parties prenantes, établir des priorités.

Étudier : Vous pourrez aborder le site du point de vue de SRE. Analyser les incidents. Déterminer comment éviter leur récurrence future : améliorer la surveillance, changer l'architecture, les approches de développement et d'exploitation, les règlements. Automatiser les processus.

Intensif en ligne SRE écape les conditions réelles — le temps pour restaurer la fonctionnalité du service sera très limité. Comme dans la vraie vie, comme dans une situation de travail réelle.

Pour connaître les conditions du cours SRE ainsi que pour étudier le programme complet, vous pouvez consulter le lien.

L'intensif en ligne est prévu pour décembre 2020. Pour ceux qui paieront leur participation à l'avance, nous avons préparé une remise.

Prêt pour un apprentissage intense, des défis atypiques et des pannes soudaines ?

Simple — il n'y aura pas. Il y aura une croissance professionnelle.

Source : habr.com

Acheter un hébergement fiable pour les sites avec protection DDoS, serveurs VPS VDS 🔥 Acheter un hébergement fiable pour les sites avec protection DDoS, serveurs VPS VDS | ProHoster