{"id":32322,"date":"2019-10-31T21:46:21","date_gmt":"2019-10-31T18:46:21","guid":{"rendered":"https:\/\/prohoster.info\/blog\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk\/"},"modified":"2019-10-31T21:46:21","modified_gmt":"2019-10-31T18:46:21","slug":"kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk","status":"publish","type":"post","link":"https:\/\/prohoster.info\/es\/blog\/administrirovanie\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk","title":{"rendered":"C\u00f3mo construimos el monitoreo en Prometheus, Clickhouse y ELK","gt_translate_keys":[{"key":"rendered","format":"text"}]},"content":{"rendered":"<p>Me llamo Anton Baderin. Trabajo en el Centro de Altas Tecnolog\u00edas y me dedico a la administraci\u00f3n de sistemas. Hace un mes, concluy\u00f3 nuestra conferencia corporativa, donde compartimos nuestra experiencia acumulada con la comunidad IT de nuestra ciudad. Habl\u00e9 sobre la monitorizaci\u00f3n de aplicaciones web. El material estaba destinado a niveles junior o medio, quienes no han desarrollado este proceso desde cero.<\/p>\n<p><\/p>\n<p><img decoding=\"async\" alt=\"C\u00f3mo construimos el monitoreo en Prometheus, Clickhouse y ELK\" src=\"\/wp-content\/uploads\/2019\/04\/c181509e6a10dd7562f361f328446d61.png\" style=\"display:block;margin: 0 auto;\" \/><\/p>\n<p><\/p>\n<p>La piedra angular de cualquier sistema de monitorizaci\u00f3n es la resoluci\u00f3n de problemas de negocio. La monitorizaci\u00f3n por la monitorizaci\u00f3n no interesa a nadie. \u00bfQu\u00e9 quiere el negocio? Que todo funcione r\u00e1pido y sin errores. El negocio desea proactividad, para que identifiquemos problemas en el servicio y los resolvamos lo m\u00e1s r\u00e1pido posible. Esa, en esencia, es la tarea que he estado resolviendo durante todo el a\u00f1o pasado en el proyecto de uno de nuestros clientes.<\/p>\n<p><noindex><a rel=\"nofollow\" name=\"habracut\"><\/a><\/noindex><\/p>\n<h2 id=\"o-proekte\">Sobre el proyecto<\/h2>\n<p><\/p>\n<p>El proyecto es uno de los programas de fidelizaci\u00f3n m\u00e1s grandes del pa\u00eds. Ayudamos a las cadenas minoristas a aumentar la frecuencia de ventas mediante diversas herramientas de marketing como las tarjetas de bonificaci\u00f3n. En total, el proyecto incluye 14 aplicaciones que operan en diez servidores.<\/p>\n<p><\/p>\n<p>Durante las entrevistas, he notado repetidamente que los administradores no siempre abordan correctamente la monitorizaci\u00f3n de aplicaciones web: muchos todav\u00eda se detienen en las m\u00e9tricas del sistema operativo y ocasionalmente monitorizan los servicios.<\/p>\n<p><\/p>\n<p>En mi caso, antes el sistema de monitorizaci\u00f3n del cliente estaba basado en Icinga. Este no resolv\u00eda las tareas mencionadas anteriormente. A menudo, el cliente nos notificaba sobre problemas y no menos veces nos faltaban datos para llegar a la ra\u00edz del problema.<\/p>\n<p><\/p>\n<p>Adem\u00e1s, hab\u00eda una clara comprensi\u00f3n de la falta de perspectivas para su desarrollo futuro. Creo que quienes conocen Icinga me entender\u00e1n. As\u00ed que decidimos rehacer completamente el sistema de monitorizaci\u00f3n de aplicaciones web en el proyecto.<\/p>\n<p><\/p>\n<h2 id=\"prometheus\">Prometheus<\/h2>\n<p><\/p>\n<p>Elegimos Prometheus, bas\u00e1ndonos en tres indicadores clave:<\/p>\n<p><\/p>\n<ol>\n<li>Una enorme cantidad de m\u00e9tricas disponibles. En nuestro caso, son 60 mil. Por supuesto, hay que destacar que la gran mayor\u00eda de ellas no las usamos (probablemente alrededor del 95%). Sin embargo, todas son relativamente baratas. Para nosotros, esta es la otra extrema, en comparaci\u00f3n con Icinga que us\u00e1bamos anteriormente. En ella, agregar m\u00e9tricas era especialmente doloroso: las existentes eran costosas (basta con mirar el c\u00f3digo fuente de cualquier complemento). Cualquier complemento era un script en Bash o Python, cuya ejecuci\u00f3n no es barata en t\u00e9rminos de recursos consumidos.<\/li>\n<li>Este sistema consume relativamente pocos recursos. Para todas nuestras m\u00e9tricas, son suficientes 600 MB de memoria RAM, el 15% de un n\u00facleo y un par de docenas de IOPS. Por supuesto, hay que ejecutar los exportadores de m\u00e9tricas, pero todos est\u00e1n escritos en Go y tampoco son muy exigentes. No creo que esto sea un problema en las realidades modernas. <\/li>\n<li>Permite la migraci\u00f3n a Kubernetes. Dado los planes del cliente, la elecci\u00f3n es obvia. <\/li>\n<\/ol>\n<p><\/p>\n<h2 id=\"elk\">ELK<\/h2>\n<p><\/p>\n<p>Antes no recolect\u00e1bamos ni proces\u00e1bamos logs. Las desventajas son evidentes para todos. Elegimos ELK, ya que ten\u00edamos experiencia previa con este sistema. All\u00ed almacenamos solo los logs de las aplicaciones. Los principales criterios de selecci\u00f3n fueron la b\u00fasqueda de texto completo y su velocidad.<\/p>\n<p><\/p>\n<h2 id=\"slickhouse\">Clickhouse<\/h2>\n<p><\/p>\n<p>Inicialmente, la elecci\u00f3n recay\u00f3 en InfluxDB. \u00c9ramos conscientes de la necesidad de recolectar logs de Nginx, estad\u00edsticas de pg_stat_statements, y almacenar datos hist\u00f3ricos de Prometheus. No nos gust\u00f3 Influx, ya que, de vez en cuando, comenzaba a consumir mucha memoria y fallaba. Adem\u00e1s, quer\u00edamos agrupar solicitudes por remote_addr, y la agrupaci\u00f3n en esta base de datos solo es posible por etiquetas. Las etiquetas son caras (en t\u00e9rminos de memoria), y su n\u00famero est\u00e1 limitadamente restringido.<\/p>\n<p><\/p>\n<p>Comenzamos la b\u00fasqueda de nuevo. Necesit\u00e1bamos una base anal\u00edtica con un m\u00ednimo consumo de recursos, preferiblemente con compresi\u00f3n de datos en disco.<\/p>\n<p><\/p>\n<p>Clickhouse cumple con todos estos criterios, y no nos hemos arrepentido de la elecci\u00f3n ni una vez. No escribimos vol\u00famenes notables de datos en \u00e9l (el n\u00famero de inserciones es de aproximadamente cinco mil por minuto).<\/p>\n<p><\/p>\n<h2 id=\"newrelic\">NewRelic<\/h2>\n<p><\/p>\n<p>NewRelic ha estado con nosotros hist\u00f3ricamente, ya que fue la elecci\u00f3n del cliente. Lo usamos como APM.<\/p>\n<p><\/p>\n<h2 id=\"zabbix\">Zabbix<\/h2>\n<p><\/p>\n<p>Usamos Zabbix exclusivamente para el monitoreo de Black Box de diversas API.<\/p>\n<p><\/p>\n<h2 id=\"opredelenie-podhoda-k-monitoringu\">Definici\u00f3n del enfoque para el monitoreo<\/h2>\n<p><\/p>\n<p>Quer\u00edamos descomponer la tarea y, as\u00ed, sistematizar el enfoque al monitoreo.<\/p>\n<p><\/p>\n<p>He dividido nuestro sistema en los siguientes niveles:<\/p>\n<p><\/p>\n<ul>\n<li>\u00abhardware\u00bb y VMS;<\/li>\n<li>sistema operativo;<\/li>\n<li>servicios del sistema, pila de software;<\/li>\n<li>aplicaci\u00f3n;<\/li>\n<li>l\u00f3gica de negocio.<\/li>\n<\/ul>\n<p><\/p>\n<p>Las ventajas de este enfoque son:<\/p>\n<p><\/p>\n<ul>\n<li>sabemos qui\u00e9n es responsable del funcionamiento de cada uno de los niveles y, a partir de esto, podemos enviar alertas;<\/li>\n<li>podemos utilizar la estructura al suprimir alertas: ser\u00eda extra\u00f1o enviar una alerta sobre la inaccesibilidad de la base de datos cuando en general la m\u00e1quina virtual est\u00e1 fuera de servicio.<\/li>\n<\/ul>\n<p><\/p>\n<p>Dado que nuestra tarea es identificar fallos en el funcionamiento del sistema, debemos en cada nivel destacar un conjunto de m\u00e9tricas en las que vale la pena enfocarse al redactar las reglas de alerta. A continuaci\u00f3n, analizaremos los niveles de \u00abVMS\u00bb, \u00abSistema operativo\u00bb y \u00abServicios del sistema, pila de software\u00bb.<\/p>\n<p><\/p>\n<h2 id=\"virtualnye-mashiny\">con procesadores gr\u00e1ficos tambi\u00e9n son necesarias en instituciones m\u00e9dicas que recopilan y analizan datos sobre pacientes y enfermedades. Trabajan con GPU y \"<\/h2>\n<p><\/p>\n<p><a class=\"wpil_keyword_link\" href=\"https:\/\/prohoster.info\/es\/\"   title=\"Hosting\" data-wpil-keyword-link=\"linked\"  data-wpil-monitor-id=\"2329\">Hosting<\/a> nos asigna CPU, disco, memoria y red. Y tuvimos problemas con los dos primeros. As\u00ed que, las m\u00e9tricas:<\/p>\n<p><\/p>\n<p>CPU stolen time: cuando compras una m\u00e1quina virtual en Amazon (por ejemplo, t2.micro), debes entender que no se te asigna un n\u00facleo completo de CPU, sino solo una cuota de su tiempo. Y cuando lo agotes, comenzar\u00e1n a robarte el procesador.<\/p>\n<p><\/p>\n<p>Esta m\u00e9trica permite rastrear esos momentos y tomar decisiones. Por ejemplo, si es necesario optar por un plan m\u00e1s robusto o distribuir el procesamiento de tareas de fondo y solicitudes de API en diferentes <a class=\"wpil_keyword_link\" href=\"https:\/\/prohoster.info\/es\/server\/dts-los-angeles\/\"   title=\"servidores\" data-wpil-keyword-link=\"linked\"  data-wpil-monitor-id=\"3493\">servidores<\/a>.<\/p>\n<p><\/p>\n<p>IOPS + CPU iowait time: por alguna raz\u00f3n, muchos hostings en la nube cometen el error de no proporcionar suficientes IOPS. Adem\u00e1s, un gr\u00e1fico con bajos IOPS para ellos no es argumento suficiente. Por lo tanto, vale la pena recopilar tambi\u00e9n CPU iowait. Con esta pareja de gr\u00e1ficos \u2014bajos IOPS y alta espera de entrada-salida\u2014 se puede empezar a conversar con el hosting y solucionar el problema.<\/p>\n<p><\/p>\n<h2 id=\"operacionnaya-sistema\">Sistema operativo<\/h2>\n<p><\/p>\n<p>M\u00e9tricas del sistema operativo:<\/p>\n<p><\/p>\n<ul>\n<li>porcentaje de memoria disponible;<\/li>\n<li>actividad en el uso de swap: vmstat swapin, swapout;<\/li>\n<li>n\u00famero de inodes disponibles y espacio libre en el sistema de archivos en %;<\/li>\n<li>carga media;<\/li>\n<li>n\u00famero de conexiones en estado tw;<\/li>\n<li>ocupaci\u00f3n de la tabla conntrack;<\/li>\n<li>la calidad del trabajo de la red se puede monitorizar utilizando la utilidad ss, con el paquete iproute2 \u2014 obtener de su salida la m\u00e9trica RTT de las conexiones y agrupar por destino de puerto.<\/li>\n<\/ul>\n<p><\/p>\n<p>Adem\u00e1s, a nivel del sistema operativo, tenemos una entidad como los procesos. Es importante destacar en el sistema un conjunto de procesos que juegan un papel clave en su funcionamiento. Si, por ejemplo, tienes varios pgpool, es necesario recopilar informaci\u00f3n sobre cada uno de ellos.<\/p>\n<p><\/p>\n<p>El conjunto de m\u00e9tricas es el siguiente:<\/p>\n<p><\/p>\n<ul>\n<li>CPU;<\/li>\n<li>la memoria es, ante todo, residente;<\/li>\n<li>IO \u2014 preferiblemente en IOPS;<\/li>\n<li>FileFd \u2014 abiertos y l\u00edmite;<\/li>\n<li>los fallos significativos de la p\u00e1gina \u2014 as\u00ed podr\u00e1s entender qu\u00e9 proceso se swap.<\/li>\n<\/ul>\n<p><\/p>\n<p>Todo nuestro monitoreo est\u00e1 desplegado en Docker, utilizamos Cadvisor para recopilar datos de m\u00e9tricas. En otras m\u00e1quinas aplicamos process-exporter.<\/p>\n<p><\/p>\n<h2 id=\"sistemnye-servisy-stek-po\">Servicios del sistema, pila de software<\/h2>\n<p><\/p>\n<p>Cada aplicaci\u00f3n tiene su propia especificidad, y es dif\u00edcil destacar un conjunto de m\u00e9tricas.<\/p>\n<p><\/p>\n<p>Un conjunto universal es:<\/p>\n<p><\/p>\n<ul>\n<li>tasa de solicitudes;<\/li>\n<li>n\u00famero de errores;<\/li>\n<li>latencia;<\/li>\n<li>saturaci\u00f3n.<\/li>\n<\/ul>\n<p><\/p>\n<p>Los ejemplos m\u00e1s destacados de monitoreo de este nivel en nuestro caso son Nginx y PostgreSQL.<\/p>\n<p><\/p>\n<p>El servicio m\u00e1s cargado en nuestro sistema es la base de datos. Antes, ten\u00edamos problemas bastante frecuentes para averiguar qu\u00e9 estaba haciendo la base de datos.<\/p>\n<p><\/p>\n<p>Vimos una alta carga en los discos, pero los slowlogs no mostraban nada relevante. Resolv\u00edmos este problema con pg_stat_statements, una vista donde se recopila estad\u00edstica sobre las consultas.<\/p>\n<p><\/p>\n<p>Eso es todo lo que necesita un administrador.<\/p>\n<p><\/p>\n<p>Construimos gr\u00e1ficos de la actividad de solicitudes de lectura y escritura:<\/p>\n<p>\n<img decoding=\"async\" alt=\"C\u00f3mo construimos el monitoreo en Prometheus, Clickhouse y ELK\" src=\"\/wp-content\/uploads\/2019\/04\/f838b7759221b284c06941291fa186df.png\" style=\"display:block;margin: 0 auto;\" \/><br \/>\n<img decoding=\"async\" alt=\"C\u00f3mo construimos el monitoreo en Prometheus, Clickhouse y ELK\" src=\"\/wp-content\/uploads\/2019\/04\/ea8684ea81f21c8d762a606aeb8342a3.png\" style=\"display:block;margin: 0 auto;\" \/><\/p>\n<p>Todo es simple y claro, cada solicitud tiene su propio color.<\/p>\n<p><\/p>\n<p>Otro ejemplo notable son los registros de Nginx. No es sorprendente que pocos los analicen o los mencionen en la lista de los obligatorios. El formato est\u00e1ndar no es muy informativo y necesita ser ampliado.<\/p>\n<p><\/p>\n<p>Personalmente, a\u00f1ad\u00ed request_time, upstream_response_time, body_bytes_sent, request_length, request_id. Construimos gr\u00e1ficos del tiempo de respuesta y el n\u00famero de errores:<\/p>\n<p>\n<img decoding=\"async\" alt=\"C\u00f3mo construimos el monitoreo en Prometheus, Clickhouse y ELK\" src=\"\/wp-content\/uploads\/2019\/04\/e517f15303f8fa780d40b7f7e30eb9ef.png\" style=\"display:block;margin: 0 auto;\" \/><br \/>\n<img decoding=\"async\" alt=\"C\u00f3mo construimos el monitoreo en Prometheus, Clickhouse y ELK\" src=\"\/wp-content\/uploads\/2019\/04\/9a07ffda75300ec939edff24532fc294.png\" style=\"display:block;margin: 0 auto;\" \/><\/p>\n<p>Construimos gr\u00e1ficos del tiempo de respuesta y el n\u00famero de errores. \u00bfRecuerdas? Habl\u00e9 sobre las tareas del negocio. Para hacerlo r\u00e1pido y sin errores. Ya hemos cerrado estas cuestiones con dos gr\u00e1ficos. Y con ellos ya se puede llamar a los administradores de guardia.<\/p>\n<p><\/p>\n<p>Pero a\u00fan queda un problema: asegurar la r\u00e1pida eliminaci\u00f3n de las causas del incidente.<\/p>\n<p><\/p>\n<h2 id=\"ustranenie-incidentov\">Eliminaci\u00f3n de incidentes<\/h2>\n<p><\/p>\n<p>Todo el proceso desde la detecci\u00f3n hasta la resoluci\u00f3n del problema se puede desglosar en una serie de pasos:<\/p>\n<p><\/p>\n<ul>\n<li>detecci\u00f3n del problema;<\/li>\n<li>notificaci\u00f3n del administrador de guardia;<\/li>\n<li>reacci\u00f3n al incidente;<\/li>\n<li>eliminaci\u00f3n de las causas.<\/li>\n<\/ul>\n<p><\/p>\n<p>Es importante que debemos hacerlo lo m\u00e1s r\u00e1pido posible. Y aunque en las etapas de detecci\u00f3n del problema y env\u00edo de la notificaci\u00f3n no podemos ganar mucho tiempo \u2014 nos llevar\u00e1n dos minutos en cualquier caso, las etapas posteriores son un campo fertil para mejoras.<\/p>\n<p><\/p>\n<p>Imaginemos que el tel\u00e9fono del operador suena. \u00bfQu\u00e9 va a hacer? \u00bfBuscar respuestas a las preguntas: qu\u00e9 se rompi\u00f3, d\u00f3nde se rompi\u00f3, c\u00f3mo reaccionar? As\u00ed es como respondemos a estas preguntas:<\/p>\n<p>\n<img decoding=\"async\" alt=\"C\u00f3mo construimos el monitoreo en Prometheus, Clickhouse y ELK\" src=\"\/wp-content\/uploads\/2019\/04\/7f33172922e646a24bb83733350b24f5.png\" style=\"display:block;margin: 0 auto;\" \/><\/p>\n<p>Simplemente incluimos toda esta informaci\u00f3n en el texto de la notificaci\u00f3n, proporcionamos un enlace a la p\u00e1gina de la wiki donde se describe c\u00f3mo reaccionar ante este problema, c\u00f3mo resolverlo y escalarlo.<\/p>\n<p><\/p>\n<p>Todav\u00eda no he mencionado nada sobre el nivel de la aplicaci\u00f3n y la l\u00f3gica empresarial. Desafortunadamente, nuestras aplicaciones a\u00fan no tienen m\u00e9tricas implementadas. La \u00fanica fuente de informaci\u00f3n de estos niveles son los registros.<\/p>\n<p><\/p>\n<p>Un par de puntos.<\/p>\n<p><\/p>\n<p>Primero, escriban registros estructurados. No incluyan el contexto en el texto del mensaje. Esto dificulta su agrupaci\u00f3n y an\u00e1lisis. Logstash requiere mucho tiempo para normalizar todo esto.<\/p>\n<p><\/p>\n<p>En segundo lugar, utilicen correctamente los niveles de gravedad. Cada lenguaje tiene su propio est\u00e1ndar. Personalmente, distingo cuatro niveles:<\/p>\n<p><\/p>\n<ol>\n<li>no hay error;<\/li>\n<li>error del lado del cliente;<\/li>\n<li>error de nuestra parte, no estamos perdiendo dinero, no asumimos riesgos;<\/li>\n<li>error de nuestra parte, estamos perdiendo dinero.<\/li>\n<\/ol>\n<p><\/p>\n<p>En resumen. Debemos esforzarnos por construir el monitoreo desde la l\u00f3gica empresarial. Intentar monitorear la propia aplicaci\u00f3n y trabajar con m\u00e9tricas como el n\u00famero de ventas, el n\u00famero de nuevas registraciones de usuarios, el n\u00famero de usuarios activos en ese momento, y as\u00ed sucesivamente.<\/p>\n<p><\/p>\n<p>Si todo su negocio es un solo bot\u00f3n en el navegador, es necesario monitorear si se presiona, si funciona correctamente. Todo lo dem\u00e1s no es importante.<\/p>\n<p><\/p>\n<p>Si no tiene esto, puede intentar compensarlo en los registros de la aplicaci\u00f3n, los registros de Nginx, etc., como hicimos nosotros. Debe estar lo m\u00e1s cerca posible de la aplicaci\u00f3n.<\/p>\n<p><\/p>\n<p>Las m\u00e9tricas del sistema operativo son, por supuesto, importantes, pero no interesan al negocio; no nos pagan por ellas.<\/p>\n<p>Fuente: <a content=\"nofollow\" rel=\"nofollow\" href=\"https:\/\/habr.com\/ru\/post\/449352\/\">habr.com<\/a><\/p>","protected":false,"gt_translate_keys":[{"key":"rendered","format":"html"}]},"excerpt":{"rendered":"<p>\u041c\u0435\u043d\u044f \u0437\u043e\u0432\u0443\u0442 \u0410\u043d\u0442\u043e\u043d \u0411\u0430\u0434\u0435\u0440\u0438\u043d. \u042f \u0440\u0430\u0431\u043e\u0442\u0430\u044e \u0432 \u0426\u0435\u043d\u0442\u0440\u0435 \u0412\u044b\u0441\u043e\u043a\u0438\u0445 \u0422\u0435\u0445\u043d\u043e\u043b\u043e\u0433\u0438\u0439 \u0438 \u0437\u0430\u043d\u0438\u043c\u0430\u044e\u0441\u044c \u0441\u0438\u0441\u0442\u0435\u043c\u043d\u044b\u043c \u0430\u0434\u043c\u0438\u043d\u0438\u0441\u0442\u0440\u0438\u0440\u043e\u0432\u0430\u043d\u0438\u0435\u043c. \u041c\u0435\u0441\u044f\u0446 \u043d\u0430\u0437\u0430\u0434 \u0437\u0430\u0432\u0435\u0440\u0448\u0438\u043b\u0430\u0441\u044c \u043d\u0430\u0448\u0430 \u043a\u043e\u0440\u043f\u043e\u0440\u0430\u0442\u0438\u0432\u043d\u0430\u044f \u043a\u043e\u043d\u0444\u0435\u0440\u0435\u043d\u0446\u0438\u044f, \u0433\u0434\u0435 \u043c\u044b \u0434\u0435\u043b\u0438\u043b\u0438\u0441\u044c \u043d\u0430\u043a\u043e\u043f\u043b\u0435\u043d\u043d\u044b\u043c \u043e\u043f\u044b\u0442\u043e\u043c \u0441 IT-\u0441\u043e\u043e\u0431\u0449\u0435\u0441\u0442\u0432\u043e\u043c \u043d\u0430\u0448\u0435\u0433\u043e \u0433\u043e\u0440\u043e\u0434\u0430. \u042f \u0440\u0430\u0441\u0441\u043a\u0430\u0437\u044b\u0432\u0430\u043b \u043f\u0440\u043e \u043c\u043e\u043d\u0438\u0442\u043e\u0440\u0438\u043d\u0433 \u0432\u0435\u0431-\u043f\u0440\u0438\u043b\u043e\u0436\u0435\u043d\u0438\u0439. \u041c\u0430\u0442\u0435\u0440\u0438\u0430\u043b \u043f\u0440\u0435\u0434\u043d\u0430\u0437\u043d\u0430\u0447\u0430\u043b\u0441\u044f \u0434\u043b\u044f \u0443\u0440\u043e\u0432\u043d\u044f junior \u0438\u043b\u0438 middle, \u043a\u043e\u0442\u043e\u0440\u044b\u0435 \u043d\u0435 \u0432\u044b\u0441\u0442\u0440\u0430\u0438\u0432\u0430\u043b\u0438 \u044d\u0442\u043e\u0442 \u043f\u0440\u043e\u0446\u0435\u0441\u0441 \u0441 \u043d\u0443\u043b\u044f. \u041a\u0440\u0430\u0435\u0443\u0433\u043e\u043b\u044c\u043d\u044b\u0439 \u043a\u0430\u043c\u0435\u043d\u044c, \u043b\u0435\u0436\u0430\u0449\u0438\u0439 \u0432 \u043e\u0441\u043d\u043e\u0432\u0435 \u043b\u044e\u0431\u043e\u0439 \u0441\u0438\u0441\u0442\u0435\u043c\u044b [&hellip;]<\/p>\n","protected":false,"gt_translate_keys":[{"key":"rendered","format":"html"}]},"author":1,"featured_media":24139,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[688],"tags":[],"class_list":["post-32322","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-administrirovanie"],"aioseo_notices":[],"aioseo_head":"\n\t\t<!-- All in One SEO 5.0.2 - aioseo.com -->\n\t<meta name=\"description\" content=\"\u041c\u0435\u043d\u044f \u0437\u043e\u0432\u0443\u0442 \u0410\u043d\u0442\u043e\u043d \u0411\u0430\u0434\u0435\u0440\u0438\u043d. \u042f \u0440\u0430\u0431\u043e\u0442\u0430\u044e \u0432 \u0426\u0435\u043d\u0442\u0440\u0435 \u0412\u044b\u0441\u043e\u043a\u0438\u0445 \u0422\u0435\u0445\u043d\u043e\u043b\u043e\u0433\u0438\u0439 \u0438 \u0437\u0430\u043d\u0438\u043c\u0430\u044e\u0441\u044c \u0441\u0438\u0441\u0442\u0435\u043c\u043d\u044b\u043c \u0430\u0434\u043c\u0438\u043d\u0438\u0441\u0442\u0440\u0438\u0440\u043e\u0432\u0430\u043d\u0438\u0435\u043c.\" \/>\n\t<meta name=\"robots\" content=\"max-image-preview:large\" \/>\n\t<meta name=\"author\" content=\"Yuri Gagarin\"\/>\n\t<link rel=\"canonical\" href=\"https:\/\/prohoster.info\/es\/blog\/administrirovanie\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk\" \/>\n\t<meta name=\"generator\" content=\"All in One SEO (AIOSEO) 5.0.2\" \/>\n\t\t<meta property=\"og:locale\" content=\"es_ES\" \/>\n\t\t<meta property=\"og:site_name\" content=\"ProHoster | \u041a\u0443\u043f\u0438\u0442\u044c \u043d\u0430\u0434\u0435\u0436\u043d\u044b\u0439 \u0445\u043e\u0441\u0442\u0438\u043d\u0433 \u0434\u043b\u044f \u0441\u0430\u0439\u0442\u043e\u0432 \u0441 \u0437\u0430\u0449\u0438\u0442\u043e\u0439 \u043e\u0442 DDoS, VPS VDS \u0441\u0435\u0440\u0432\u0435\u0440\u044b\" \/>\n\t\t<meta property=\"og:type\" content=\"article\" \/>\n\t\t<meta property=\"og:title\" content=\"\ud83e\udd47\u041a\u0430\u043a \u043c\u044b \u0441\u0442\u0440\u043e\u0438\u043b\u0438 \u043c\u043e\u043d\u0438\u0442\u043e\u0440\u0438\u043d\u0433 \u043d\u0430 Prometheus, Clickhouse \u0438 ELK | ProHoster\" \/>\n\t\t<meta property=\"og:description\" content=\"\u041c\u0435\u043d\u044f \u0437\u043e\u0432\u0443\u0442 \u0410\u043d\u0442\u043e\u043d \u0411\u0430\u0434\u0435\u0440\u0438\u043d. \u042f \u0440\u0430\u0431\u043e\u0442\u0430\u044e \u0432 \u0426\u0435\u043d\u0442\u0440\u0435 \u0412\u044b\u0441\u043e\u043a\u0438\u0445 \u0422\u0435\u0445\u043d\u043e\u043b\u043e\u0433\u0438\u0439 \u0438 \u0437\u0430\u043d\u0438\u043c\u0430\u044e\u0441\u044c \u0441\u0438\u0441\u0442\u0435\u043c\u043d\u044b\u043c \u0430\u0434\u043c\u0438\u043d\u0438\u0441\u0442\u0440\u0438\u0440\u043e\u0432\u0430\u043d\u0438\u0435\u043c.\" \/>\n\t\t<meta property=\"og:url\" content=\"https:\/\/prohoster.info\/es\/blog\/administrirovanie\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk\" \/>\n\t\t<meta property=\"og:image\" content=\"https:\/\/prohoster.info\/wp-content\/uploads\/2021\/11\/logo-350.jpg\" \/>\n\t\t<meta property=\"og:image:secure_url\" content=\"https:\/\/prohoster.info\/wp-content\/uploads\/2021\/11\/logo-350.jpg\" \/>\n\t\t<meta property=\"og:image:width\" content=\"350\" \/>\n\t\t<meta property=\"og:image:height\" content=\"350\" \/>\n\t\t<meta property=\"article:published_time\" content=\"2019-10-31T18:46:21+00:00\" \/>\n\t\t<meta property=\"article:modified_time\" content=\"2019-10-31T18:46:21+00:00\" \/>\n\t\t<meta property=\"article:publisher\" content=\"https:\/\/www.facebook.com\/prohoster\" \/>\n\t\t<meta property=\"article:author\" content=\"https:\/\/www.facebook.com\/prohoster\" \/>\n\t\t<!-- All in One SEO -->\n\n","aioseo_head_json":{"title":"\ud83e\udd47C\u00f3mo construimos el monitoreo en Prometheus, Clickhouse y ELK | ProHoster","description":"Me llamo Anton Baderin. Trabajo en el Centro de Alta Tecnolog\u00eda y me ocupo de la administraci\u00f3n de sistemas.","canonical_url":"https:\/\/prohoster.info\/es\/blog\/administrirovanie\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk","robots":"max-image-preview:large","keywords":"","webmasterTools":{"miscellaneous":""},"schema":null,"og:locale":"es_ES","og:site_name":"ProHoster | \u041a\u0443\u043f\u0438\u0442\u044c \u043d\u0430\u0434\u0435\u0436\u043d\u044b\u0439 \u0445\u043e\u0441\u0442\u0438\u043d\u0433 \u0434\u043b\u044f \u0441\u0430\u0439\u0442\u043e\u0432 \u0441 \u0437\u0430\u0449\u0438\u0442\u043e\u0439 \u043e\u0442 DDoS, VPS VDS \u0441\u0435\u0440\u0432\u0435\u0440\u044b","og:type":"article","og:title":"\ud83e\udd47\u041a\u0430\u043a \u043c\u044b \u0441\u0442\u0440\u043e\u0438\u043b\u0438 \u043c\u043e\u043d\u0438\u0442\u043e\u0440\u0438\u043d\u0433 \u043d\u0430 Prometheus, Clickhouse \u0438 ELK | ProHoster","og:description":"\u041c\u0435\u043d\u044f \u0437\u043e\u0432\u0443\u0442 \u0410\u043d\u0442\u043e\u043d \u0411\u0430\u0434\u0435\u0440\u0438\u043d. \u042f \u0440\u0430\u0431\u043e\u0442\u0430\u044e \u0432 \u0426\u0435\u043d\u0442\u0440\u0435 \u0412\u044b\u0441\u043e\u043a\u0438\u0445 \u0422\u0435\u0445\u043d\u043e\u043b\u043e\u0433\u0438\u0439 \u0438 \u0437\u0430\u043d\u0438\u043c\u0430\u044e\u0441\u044c \u0441\u0438\u0441\u0442\u0435\u043c\u043d\u044b\u043c \u0430\u0434\u043c\u0438\u043d\u0438\u0441\u0442\u0440\u0438\u0440\u043e\u0432\u0430\u043d\u0438\u0435\u043c.","og:url":"https:\/\/prohoster.info\/es\/blog\/administrirovanie\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk","og:image":"https:\/\/prohoster.info\/wp-content\/uploads\/2021\/11\/logo-350.jpg","og:image:secure_url":"https:\/\/prohoster.info\/wp-content\/uploads\/2021\/11\/logo-350.jpg","og:image:width":350,"og:image:height":350,"article:published_time":"2019-10-31T18:46:21+00:00","article:modified_time":"2019-10-31T18:46:21+00:00","article:publisher":"https:\/\/www.facebook.com\/prohoster","article:author":"https:\/\/www.facebook.com\/prohoster"},"aioseo_meta_data":{"post_id":"32322","title":null,"description":null,"keywords":null,"keyphrases":null,"primary_term":null,"canonical_url":null,"og_title":null,"og_description":null,"og_object_type":"default","og_image_type":"default","og_image_url":null,"og_image_width":null,"og_image_height":null,"og_image_custom_url":null,"og_image_custom_fields":null,"og_video":null,"og_custom_url":null,"og_article_section":null,"og_article_tags":null,"twitter_use_og":false,"twitter_card":"default","twitter_image_type":"default","twitter_image_url":null,"twitter_image_custom_url":null,"twitter_image_custom_fields":null,"twitter_title":null,"twitter_description":null,"schema":{"blockGraphs":[],"customGraphs":[],"default":{"data":{"Article":[],"Course":[],"Dataset":[],"FAQPage":[],"Movie":[],"Person":[],"Product":[],"ProductReview":[],"Car":[],"Recipe":[],"Service":[],"SoftwareApplication":[],"WebPage":[]},"graphName":"","isEnabled":true},"graphs":[]},"schema_type":null,"schema_type_options":null,"pillar_content":false,"robots_default":true,"robots_noindex":false,"robots_noarchive":false,"robots_nosnippet":false,"robots_nofollow":false,"robots_noimageindex":false,"robots_noodp":false,"robots_notranslate":false,"robots_max_snippet":null,"robots_max_videopreview":null,"robots_max_imagepreview":"large","priority":null,"frequency":null,"local_seo":null,"seo_analyzer_scan_date":"2026-02-22 15:34:41","breadcrumb_settings":null,"limit_modified_date":false,"reviewed_by":null,"ai":null,"created":"2021-03-01 03:00:23","updated":"2026-02-22 15:34:41","focus_keyword":null,"additional_keywords":null,"truseo_locale":null},"gt_translate_keys":[{"key":"link","format":"url"}],"_links":{"self":[{"href":"https:\/\/prohoster.info\/es\/wp-json\/wp\/v2\/posts\/32322","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/prohoster.info\/es\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/prohoster.info\/es\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/prohoster.info\/es\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/prohoster.info\/es\/wp-json\/wp\/v2\/comments?post=32322"}],"version-history":[{"count":2,"href":"https:\/\/prohoster.info\/es\/wp-json\/wp\/v2\/posts\/32322\/revisions"}],"predecessor-version":[{"id":162019,"href":"https:\/\/prohoster.info\/es\/wp-json\/wp\/v2\/posts\/32322\/revisions\/162019"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/prohoster.info\/es\/wp-json\/wp\/v2\/media\/24139"}],"wp:attachment":[{"href":"https:\/\/prohoster.info\/es\/wp-json\/wp\/v2\/media?parent=32322"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/prohoster.info\/es\/wp-json\/wp\/v2\/categories?post=32322"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/prohoster.info\/es\/wp-json\/wp\/v2\/tags?post=32322"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}