Épico sobre los administradores de sistemas como una especie en peligro de extinción

Administradores de sistemas de todo el mundo, ¡los felicitamos en su día profesional!

No nos quedan administradores de sistemas (bueno, casi). Sin embargo, la leyenda sobre ellos aún está fresca. En honor a la celebración, hemos preparado esta epopeya. Pónganse cómodos, queridos lectores.

Épico sobre los administradores de sistemas como una especie en peligro de extinción

Érase una vez un mundo de Dodo IS en llamas. En aquel oscuro tiempo, la principal tarea de nuestros administradores de sistemas era sobrevivir un día más y no llorar.

Hace mucho tiempo, los programadores escribían poco y lentamente, y lo publicaban en producción una vez a la semana. Así que los problemas surgían solo una vez cada siete días. Pero luego comenzaron a escribir más código y a publicarlo con más frecuencia, los problemas aumentaron, a veces todo colapsaba y los retrocesos eran más difíciles. Los administradores de sistemas sufrían, pero soportaban este caos.

Se sentaban por las noches en casa con inquietud en el alma. Y cada vez sucedía: "nunca fue así, y de nuevo el monitoreo envía una señal de emergencia: ¡Amigo, el mundo está en llamas!" Entonces, nuestros sysadmins se ponían sus capas rojas, calzoncillos sobre mallas, se hacían una onda en la frente y volaban a salvar el mundo de Dodo.

Atención, una pequeña aclaración. Nunca hemos tenido administradores de sistemas clásicos, que se encarguen del hardware, en Dodo IS. Desde el principio, tuvimos avanzados en la nube de Azure.

¿Qué hacían entonces?

  • si algo se rompía, hacían que se arreglara;
  • hacían malabares con servidores a nivel experto;
  • eran responsables de la red virtual en Azure;
  • se ocupaban de cosas de bajo nivel, por ejemplo, la interacción de componentes (*en voz baja* sobre los que a veces no sabían nada);
  • reconectando servidores;
  • y muchas otras locuras.

La vida del equipo de ingenieros de infraestructura (así llamábamos a nuestros sysadmins) consistía en apagar incendios y lidiar con entornos de prueba que siempre fallaban. Vivían y sufrían, y luego decidieron reflexionar: ¿por qué está todo tan mal? ¿No podríamos hacerlo mejor? Por ejemplo, ¿no podríamos dejar de dividir a las personas en programadores y sysadmins?

La pregunta

Dado: hay un sysadmin cuyo ámbito de responsabilidad son los servidores, la red que lo conecta con otros servidores, programas de nivel de infraestructura (servidor web que aloja la aplicación, sistema de gestión de bases de datos, etc.). Y hay un programador cuyo ámbito de responsabilidad es el código funcional.

¿Y qué pasa con las cosas que se encuentran en la intersección? ¿De quién es la responsabilidad?

Usualmente, en este punto era donde nuestros administradores de sistemas y programadores se encontraban y empezaba:

– Chicos, no funciona nada, probablemente por la infraestructura.
– Chicos, no, el problema está en el código.

Una vez, en este momento, comenzó a crecer una cerca entre ellos, desde donde alegremente se lanzaban excrementos. La tarea, como un excremento, se pasaba de un lado de la cerca al otro. Mientras tanto, nadie se acercaba a resolver la situación. Carita triste.

Un rayo de sol atravesó el cielo nublado, cuando hace unos años en Google decidieron no intercambiar tareas, sino hacer un trabajo común.

¿Y si describimos todo como código?

En 2016, Google lanzó un pequeño libro llamado 'Site Reliability Engineering' sobre la transformación del rol del administrador de sistemas: de maestro de la magia a un enfoque de ingeniería formalizado en el uso de software y automatización. Ellos mismos pasaron por todas las dificultades y obstáculos, aprendieron y decidieron compartir esto con el mundo. El libro está disponible públicamente. aquí.

El libro contiene verdades simples:

  • hacer todo como código es bueno;
  • usar un enfoque ingenieril es bueno;
  • hacer buen monitoreo es bueno;
  • no permitir que un servicio se lance si no tiene un registro y monitoreo claros, también es bueno.

Estas prácticas las leyó nuestro Gleb (entropy), y ¡empezamos! Ahora estamos en una etapa de transición. El equipo SRE está conformado (hay 6 especialistas listos y 6 más en proceso de incorporación) y está listo para cambiar el mundo, que consiste completamente en código, para mejor.

Estamos creando nuestra infraestructura de tal manera que permita a los desarrolladores gestionar completamente sus entornos por sí mismos y colaborar con SRE.

Predicamos en lugar de hacer conclusiones

El administrador de sistemas es una profesión digna. Pero además de los conocimientos técnicos, también se necesitan excelentes habilidades de ingeniería de software.

Los sistemas se están volviendo cada vez más sencillos, y los conocimientos super únicos sobre la administración de servidores físicos son cada vez menos demandados. Las tecnologías en la nube están desplazando la necesidad de estos conocimientos.

Un buen administrador de sistemas en un futuro cercano deberá poseer habilidades sólidas de ingeniería de software. Y aún mejor, que cuente con buenas habilidades en este ámbito.

Nadie puede predecir el futuro hasta que llega, pero creemos que con el tiempo habrá cada vez menos empresas dispuestas a aumentar indefinidamente su plantilla de administradores de sistemas. Aunque, por supuesto, siempre habrá entusiastas. Actualmente, pocas personas montan a caballo; la mayoría usa automóviles, aunque aún hay quienes lo disfrutan.

¡Feliz Día del Administrador de Sistemas a todos, que el código fluya!

Fuente: habr.com

Compra un hosting fiable para sitios web con protección contra DDoS, servidores VPS VDS 🔥 Compra un hosting fiable para sitios web con protección contra DDoS, servidores VPS VDS | ProHoster