Ами да направим нещо лошо? Все строим и строим, ремонтираме и ремонтираме. Ужасна скука.
Нека направим нещо, за което няма да ни се случи нищо — освен това, да ни похвалят за това безобразие. А след това отново ще построим всичко — и то така, че да бъде много по-добро, устойчиво и по-бързо.
И отново ще направим нещо лошо.
Мислите, че това е конкурс за ползване на най-секретния инструмент на цялата ни космонавтика — Голямото руско космическо чукало?
Не, това е онлайн интензивен курс SRE. Стана така, че всеки курс никога не е и никога няма да бъде същият като предишния. Просто защото никога не можеш да предположиш какво в огромната сложна система, към която всяка секунда се свързват хиляди и хиляди потребители, а самата аудитория наброява няколко милиона, може да се затрудни, провали, застои, забави и стотици начини да развали настроението на дежурната смяна на SRE-инженерите.
През декември ще проведем нов .

Организирайки малка ретроспектива. Спомнете си, как само преди няколко години HR-ите организираха състезания, кой ще привлече повече DevOps-инженери в своята компания. Наградата се е променила. Сега те, като следяща система „Панцирь-С1“, оглеждат околното пространство, търсейки SRE-инженери. Разказах в статията „“, как се живее на SRE-инженерите в Google и как дори такава корпорация изпитва недостиг на специалисти SRE.
На онлайн интензивния през декември в рамките на три дни, от 10:00 до 19:00, ще научите как да осигурявате бързодействие, устойчивост и достъпност на сайтовете при ограничени ресурси, да ликвидирате ИТ инциденти и да провеждате анализи на полетите, за да избегнете повтаряне на проблемите.
Лекторите на курса:
Иван Круглов. Staff Software Engineer в Databricks. Има опит в корпоративни компании в разпределената доставка и обработка на съобщения, BigData и web-stack, създаване на вътрешно облако, service mesh.
Павел Селиванов. Senior DevOps Engineer в Mail.ru Cloud Solutions. С десетки изградени инфраструктури и стотици написани пайплайни CI/CD. Сертифициран администратор на Kubernetes. Автор на няколко курса по Kubernetes и DevOps. Редовен лектор на руски и международни ИТ конференции.
Всичко ще бъде интензивно, непредсказуемо и практично. Вие ще строите, ще разрушавате и ще ремонтирате — понякога в различни последователности.
Строене: Вие трябва да формулирате показатели SLO, SLI, SLA за сайт, състоящ се от няколко микросервиза; да разработите архитектура и инфраструктура, които да ги осигурят; да съберете, тествате и внедрите сайта; да настроите мониторинг и алармиране.
Разрушаване: Ще разгледате вътрешни и външни фактори, които влошават SLO: грешки на разработчиците, откази на инфраструктурата, наплив на посетители, DoS-атаки. Ще се научите да разбирате устойчивостта, бюджет за грешки, практика на тестване, управление на прекъсвания и оперативна натовареност.
Ремонт: Ще бъдете обучени бързо и ефективно да организирате работата на екип за справяне с аварии в минимални срокове: да включите колеги, да уведомите заинтересованите страни (stakeholders), да установите приоритети.
Изучаване: Ще можете да разгледате подхода към сайта от гледна точка на SRE. Да анализирате инциденти. Да определите как да ги избегнете в бъдеще: да подобрите мониторинга, да промените архитектурата, подходите към разработване и експлоатация, регламентите. Да автоматизирате процесите.
имитира реални условия — времето за възстановяване на работоспособността на услугата ще бъде изключително ограничено. Както в реалния живот, както в истинска работна ситуация.
Да научите условията на курса SRE и пълната програма можете на .
Онлайн интензивът е планиран за декември 2020 година. За тези, които заплатят участието предварително, сме подготвили отстъпка.
Готови ли сте за интензивно обучение, нестандартни задачи и внезапни аварии?
Просто — няма да има. Ще има професионален растеж.
Източник: habr.com
