Să încercăm să distrugem ceva? Tot ce facem este să construim și să reparăm. E o plictiseală mortală.
Hai să distrugem astfel încât să nu pătimim nimic — ba mai mult, să fim chiar lăudați pentru această nelegiuire. Apoi reconstruim totul — astfel încât să fie cu mult mai bun, mai fiabil și mai rapid.
Și din nou vom distruge.
Credeți că acesta este un concurs pentru aplicarea celui mai secret instrument al întregii noastre cosmonautici — Marele Ciocan Rus?
Nu, este un curs online de SRE. Așa s-a nimerit că fiecare curs nu este niciodată la fel cu precedentul. Pur și simplu, pentru că niciodată nu poți băga de seamă ce într-o sistem complex vast, la care se conectează mii și mii de utilizatori în fiecare secundă, și care are o audiență de milioane, se poate rupe, distruge, bloca, strica și în sute de alte moduri să strice dispoziția echipei de ingineri SRE.
În decembrie vom organiza din nou .

Vom face o mică retrospective. Amintiți-vă cum, cu doar câțiva ani în urmă, HR-ii organizau curse pentru a captura cât mai mulți ingineri DevOps în compania lor. Premiul s-a schimbat. Acum ei, ca un sistem de monitorizare „Pancir-S1”, examinează împrejurimile, căutând ingineri SRE. Am povestit în articolul „”, despre cum se descurcă un inginer SRE la Google și cum chiar și o astfel de corporație resimte o penurie de specialiști SRE.
La intensiva online din decembrie, în trei zile, între orele 10:00 și 19:00, veți învăța să asigurați performanța, fiabilitatea și disponibilitatea site-urilor în condiții de resurse limitate, să eliminați incidentele IT și să desfășurați analize post-eveniment astfel încât problemele să nu se repete.
Speakerii cursului:
Ivan Kruglov. Inginer Software Staff la Databricks. Are experiență în companii enterprise în livrarea și procesarea distribuită a mesajelor, Big Data și web-stack, căutare, construire de cloud intern, service mesh.
Pavel Selivanov. Inginer Senior DevOps la Mail.ru Cloud Solutions. A construit zeci de infrastructuri și a scris sute de pipeline-uri CI/CD. Administrator Kubernetes certificat. Autor al mai multor cursuri despre Kubernetes și DevOps. Vorbitor frecvent la conferințe IT din Rusia și internaționale.
Totul se va desfășura într-o manieră severă, imprevizibilă și practică. Vei construi, vei distruge și vei repara — uneori în cele mai diverse secvențe.
Construiește: Va trebui să formulezi indicatorii SLO, SLI, SLA pentru un site compus din mai multe microservicii; să dezvolți arhitectura și infrastructura care le va susține; să aduni, să testezi și să implementezi site-ul; să configurezi monitorizarea și alertele.
Distruge: Veți analiza factorii interni și externi care afectează SLO: erori de codare, defecțiuni ale infrastructurii, trafic crescut, atacuri DoS. Vei învăța să înțelegi reziliența, bugetul de erori, practicile de testare, gestionarea întreruperilor și încărcarea operațională.
Repară: Vei fi instruit să organizezi rapid și eficient activitatea unui grup de eliminare a incidentelor într-un timp minim: să aduni colegii, să notifici părțile interesate, să stabilești priorități.
Cercetează: Vei putea analiza abordarea site-ului din perspectiva SRE. Să analizezi incidentele. Să determini cum să le eviți în viitor: să îmbunătățești monitorizarea, să schimbi arhitectura, metodele de dezvoltare și operare, reglementările. Să automatizezi procesele.
simulează condiții reale — timpul pentru recuperarea funcționalității serviciului va fi extrem de limitat. Ca în viața reală, ca într-o situație de lucru autentică.
Află condițiile cursului SRE, precum și întreaga programă, accesând .
Intensivul online este programat pentru decembrie 2020. Pentru cei care plătesc participarea în avans, am pregătit o reducere.
Ești pregătit pentru un învățământ intens, provocări neobișnuite și incidente neașteptate?
Simplu — nu va fi. Va fi o creștere profesională.
Sursa: habr.com
