{"id":32322,"date":"2019-10-31T21:46:21","date_gmt":"2019-10-31T18:46:21","guid":{"rendered":"https:\/\/prohoster.info\/blog\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk\/"},"modified":"2019-10-31T21:46:21","modified_gmt":"2019-10-31T18:46:21","slug":"kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk","status":"publish","type":"post","link":"https:\/\/prohoster.info\/fr\/blog\/administrirovanie\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk","title":{"rendered":"Comment nous avons construit la surveillance sur Prometheus, Clickhouse et ELK","gt_translate_keys":[{"key":"rendered","format":"text"}]},"content":{"rendered":"<p>Je m'appelle Anton Baderin. Je travaille au Centre des Hautes Technologies et je m'occupe de l'administration syst\u00e8me. Il y a un mois, notre conf\u00e9rence d'entreprise a eu lieu, o\u00f9 nous avons partag\u00e9 notre exp\u00e9rience accumul\u00e9e avec la communaut\u00e9 IT de notre ville. J'ai parl\u00e9 de la surveillance des applications web. Le mat\u00e9riel \u00e9tait destin\u00e9 \u00e0 un niveau junior ou interm\u00e9diaire, qui n'avait pas mis en place ce processus depuis le d\u00e9but.<\/p>\n<p><\/p>\n<p><img decoding=\"async\" alt=\"Comment nous avons construit la surveillance sur Prometheus, Clickhouse et ELK\" src=\"\/wp-content\/uploads\/2019\/04\/c181509e6a10dd7562f361f328446d61.png\" style=\"display:block;margin: 0 auto;\" \/><\/p>\n<p><\/p>\n<p>La pierre angulaire de tout syst\u00e8me de surveillance est la r\u00e9solution des probl\u00e8mes d'entreprise. La surveillance pour la surveillance n'int\u00e9resse personne. Que veut l'entreprise ? Que tout fonctionne rapidement et sans erreurs. L'entreprise souhaite de la proactivit\u00e9, afin que nous puissions identifier les probl\u00e8mes dans le fonctionnement du service et les r\u00e9soudre aussi rapidement que possible. C'est, en substance, les d\u00e9fis que j'ai relev\u00e9s tout au long de l'ann\u00e9e pr\u00e9c\u00e9dente pour le projet d'un de nos clients.<\/p>\n<p><noindex><a rel=\"nofollow\" name=\"habracut\"><\/a><\/noindex><\/p>\n<h2 id=\"o-proekte\">\u00c0 propos du projet<\/h2>\n<p><\/p>\n<p>Le projet est l'un des plus grands programmes de fid\u00e9lit\u00e9 du pays. Nous aidons les cha\u00eenes de vente au d\u00e9tail \u00e0 augmenter la fr\u00e9quence des ventes par divers outils marketing tels que les cartes de fid\u00e9lit\u00e9. Au total, le projet comprend 14 applications qui fonctionnent sur dix serveurs.<\/p>\n<p><\/p>\n<p>Au cours des entretiens, j'ai souvent remarqu\u00e9 que les administrateurs ne s'approchent pas toujours correctement de la surveillance des applications web : beaucoup se limitent encore aux m\u00e9triques du syst\u00e8me d'exploitation et surveillent occasionnellement les services.<\/p>\n<p><\/p>\n<p>Dans mon cas, la solution de surveillance du client reposait auparavant sur Icinga. Elle ne r\u00e9pondait en rien aux d\u00e9fis susmentionn\u00e9s. Souvent, le client nous informait lui-m\u00eame des probl\u00e8mes et il nous manquait souvent des donn\u00e9es pour comprendre la cause.<\/p>\n<p><\/p>\n<p>De plus, il \u00e9tait clair qu'il n'y avait pas d'avenir pour son d\u00e9veloppement ult\u00e9rieur. Je pense que ceux qui connaissent Icinga comprendront. Donc, nous avons d\u00e9cid\u00e9 de retravailler compl\u00e8tement le syst\u00e8me de surveillance des applications web pour le projet.<\/p>\n<p><\/p>\n<h2 id=\"prometheus\">Prometheus<\/h2>\n<p><\/p>\n<p>Nous avons choisi Prometheus sur la base de trois indicateurs principaux :<\/p>\n<p><\/p>\n<ol>\n<li>Un grand nombre de m\u00e9triques disponibles. Dans notre cas, il y en a 60 000. Bien s\u00fbr, il convient de noter que la grande majorit\u00e9 d'entre elles ne sont pas utilis\u00e9es (probablement environ 95 %). D'autre part, elles sont toutes relativement bon march\u00e9. Pour nous, c'est l'autre extr\u00eame, compar\u00e9 \u00e0 Icinga que nous utilisions auparavant. Dans celui-ci, l'ajout de m\u00e9triques posait un r\u00e9el probl\u00e8me : celles existantes \u00e9taient co\u00fbteuses (il suffit de regarder le code source de n'importe quel plugin). Chaque plugin \u00e9tait un script en Bash ou en Python, dont l'ex\u00e9cution n'est pas bon march\u00e9 en termes de ressources consomm\u00e9es.<\/li>\n<li>Ce syst\u00e8me consomme relativement peu de ressources. Pour toutes nos m\u00e9triques, 600 Mo de RAM, 15 % d'un c\u0153ur et quelques dizaines d'IOPS suffisent. Bien s\u00fbr, il faut ex\u00e9cuter des exportateurs de m\u00e9triques, mais tous sont \u00e9crits en Go et ne sont pas non plus tr\u00e8s gourmands. Je ne pense pas que ce soit un probl\u00e8me dans les r\u00e9alit\u00e9s modernes. <\/li>\n<li>Permet de passer \u00e0 Kubernetes. \u00c9tant donn\u00e9 les plans du client, le choix est \u00e9vident. <\/li>\n<\/ol>\n<p><\/p>\n<h2 id=\"elk\">ELK<\/h2>\n<p><\/p>\n<p>Nous ne collectons ni ne traitons les logs auparavant. Les inconv\u00e9nients sont clairs pour tout le monde. Nous avons choisi ELK, car nous avions d\u00e9j\u00e0 de l'exp\u00e9rience avec ce syst\u00e8me. Nous n'y stockons que les logs des applications. Les principaux crit\u00e8res de choix \u00e9taient la recherche full-text et sa rapidit\u00e9.<\/p>\n<p><\/p>\n<h2 id=\"slickhouse\">Clickhouse<\/h2>\n<p><\/p>\n<p>Au d\u00e9part, nous avons opt\u00e9 pour InfluxDB. Nous \u00e9tions conscients de la n\u00e9cessit\u00e9 de collecter les logs Nginx, les statistiques de pg_stat_statements et de stocker les donn\u00e9es historiques de Prometheus. L'Influx ne nous a pas plu, car il commen\u00e7ait p\u00e9riodiquement \u00e0 consommer une grande quantit\u00e9 de m\u00e9moire et s'effondrait. De plus, nous voulions regrouper les requ\u00eates par remote_addr, mais cette SGBD ne permet le regroupement que par tags. Les tags sont co\u00fbteux (en m\u00e9moire), leur nombre est conditionnellement limit\u00e9.<\/p>\n<p><\/p>\n<p>Nous avons recommenc\u00e9 les recherches. Il nous fallait une base analytique avec une consommation minimale de ressources, de pr\u00e9f\u00e9rence avec compression des donn\u00e9es sur disque.<\/p>\n<p><\/p>\n<p>Clickhouse r\u00e9pond \u00e0 tous ces crit\u00e8res, et nous n'avons jamais regrett\u00e9 notre choix. Nous n'\u00e9crivons pas des volumes de donn\u00e9es exceptionnels (le nombre d'inserts est d'environ cinq mille par minute).<\/p>\n<p><\/p>\n<h2 id=\"newrelic\">NewRelic<\/h2>\n<p><\/p>\n<p>NewRelic a historiquement \u00e9t\u00e9 avec nous, car c'\u00e9tait le choix du client. Nous l'utilisons comme APM.<\/p>\n<p><\/p>\n<h2 id=\"zabbix\">Zabbix<\/h2>\n<p><\/p>\n<p>Nous utilisons Zabbix exclusivement pour surveiller la Black Box de diverses API.<\/p>\n<p><\/p>\n<h2 id=\"opredelenie-podhoda-k-monitoringu\">D\u00e9finition de l'approche de monitoring<\/h2>\n<p><\/p>\n<p>Nous souhaitions d\u00e9composer la t\u00e2che pour syst\u00e9matiser l'approche de monitoring.<\/p>\n<p><\/p>\n<p>Pour cela, j'ai divis\u00e9 notre syst\u00e8me en plusieurs niveaux :<\/p>\n<p><\/p>\n<ul>\n<li>mat\u00e9riel et VMS ;<\/li>\n<li>syst\u00e8me d'exploitation ;<\/li>\n<li>services syst\u00e8me, stack logiciel ;<\/li>\n<li>application ;<\/li>\n<li>logique m\u00e9tier.<\/li>\n<\/ul>\n<p><\/p>\n<p>Les avantages de cette approche :<\/p>\n<p><\/p>\n<ul>\n<li>nous savons qui est responsable du fonctionnement de chaque niveau et, en fonction de cela, nous pouvons envoyer des alertes ;<\/li>\n<li>nous pouvons utiliser la structure lors de la suppression d'alertes - il serait \u00e9trange d'envoyer une alerte sur l'indisponibilit\u00e9 de la base de donn\u00e9es alors que la machine virtuelle dans son ensemble est indisponible.<\/li>\n<\/ul>\n<p><\/p>\n<p>\u00c9tant donn\u00e9 que notre t\u00e2che est d'identifier les anomalies dans le fonctionnement du syst\u00e8me, nous devons d\u00e9finir un ensemble de m\u00e9triques \u00e0 chaque niveau, sur lesquelles il est essentiel de se concentrer lors de la r\u00e9daction des r\u00e8gles d'alerte. Nous passerons ensuite en revue les niveaux \u00ab VMS \u00bb, \u00ab Syst\u00e8me d'exploitation \u00bb et \u00ab Services syst\u00e8me, stack logiciel \u00bb.<\/p>\n<p><\/p>\n<h2 id=\"virtualnye-mashiny\">Machines virtuelles<\/h2>\n<p><\/p>\n<p><a class=\"wpil_keyword_link\" href=\"https:\/\/prohoster.info\/fr\/\"   title=\"H\u00e9bergement\" data-wpil-keyword-link=\"linked\"  data-wpil-monitor-id=\"2329\">H\u00e9bergement<\/a> il nous attribue le processeur, le disque, la m\u00e9moire et le r\u00e9seau. Et nous avons eu des probl\u00e8mes avec les deux premiers. Donc, les m\u00e9triques :<\/p>\n<p><\/p>\n<p>Temps de CPU vol\u00e9 - lorsque vous achetez une machine virtuelle sur Amazon (t2.micro, par exemple), il faut comprendre que vous ne obtenez pas un c\u0153ur de processeur complet, mais seulement un quota de son temps. Et lorsque vous atteignez cette limite, le processeur commencera \u00e0 vous \u00eatre retir\u00e9.<\/p>\n<p><\/p>\n<p>Cette m\u00e9trique permet de suivre de tels moments et de prendre des d\u00e9cisions. Par exemple, faut-il choisir un tarif plus \u00e9lev\u00e9 ou r\u00e9partir le traitement des t\u00e2ches en arri\u00e8re-plan et les requ\u00eates API sur diff\u00e9rentes <a class=\"wpil_keyword_link\" href=\"https:\/\/prohoster.info\/fr\/server\/dts-los-angeles\/\"   title=\"de serveurs\" data-wpil-keyword-link=\"linked\"  data-wpil-monitor-id=\"3493\">de serveurs<\/a>.<\/p>\n<p><\/p>\n<p>IOPS + temps d'attente CPU - pour une raison quelconque, de nombreux h\u00e9bergeurs cloud commettent l'erreur de sous-estimer les IOPS. De plus, un graphique avec des IOPS faibles ne leur pose pas de probl\u00e8me. C'est pourquoi il est utile de collecter \u00e9galement le temps d'attente CPU. Avec cette paire de graphiques - IOPS faibles et attente d'entr\u00e9e-sortie \u00e9lev\u00e9e - il est possible de discuter avec l'h\u00e9bergeur et de r\u00e9soudre le probl\u00e8me.<\/p>\n<p><\/p>\n<h2 id=\"operacionnaya-sistema\">Syst\u00e8me d'exploitation<\/h2>\n<p><\/p>\n<p>M\u00e9triques du syst\u00e8me d'exploitation :<\/p>\n<p><\/p>\n<ul>\n<li>pourcentage de m\u00e9moire disponible ;<\/li>\n<li>activit\u00e9 d'utilisation du swap : vmstat swapin, swapout ;<\/li>\n<li>nombre d'inodes disponibles et d'espace libre sur le syst\u00e8me de fichiers en % ;<\/li>\n<li>charge moyenne ;<\/li>\n<li>nombre de connexions en \u00e9tat tw ;<\/li>\n<li>remplissage de la table conntrack ;<\/li>\n<li>la qualit\u00e9 du r\u00e9seau peut \u00eatre surveill\u00e9e \u00e0 l'aide de l'utilitaire ss, avec le paquet iproute2 - obtenir \u00e0 partir de sa sortie une mesure RTT des connexions et regrouper par port de destination.<\/li>\n<\/ul>\n<p><\/p>\n<p>De plus, au niveau du syst\u00e8me d'exploitation, nous avons une entit\u00e9 comme les processus. Il est important de d\u00e9finir dans le syst\u00e8me un ensemble de processus qui jouent un r\u00f4le cl\u00e9 dans son fonctionnement. Par exemple, si vous avez plusieurs pgpool, il est n\u00e9cessaire de collecter des informations sur chacun d'entre eux.<\/p>\n<p><\/p>\n<p>L'ensemble des m\u00e9triques est le suivant :<\/p>\n<p><\/p>\n<ul>\n<li>CPU ;<\/li>\n<li>la m\u00e9moire \u2014 avant tout, r\u00e9sidente ;<\/li>\n<li>IO \u2014 de pr\u00e9f\u00e9rence en IOPS ;<\/li>\n<li>FileFd \u2014 ouverts et limite ;<\/li>\n<li>\u00e9checs majeurs des pages \u2014 cela vous permettra de comprendre quel processus est \u00e9chang\u00e9.<\/li>\n<\/ul>\n<p><\/p>\n<p>Toute notre surveillance est d\u00e9ploy\u00e9e dans Docker, pour collecter les donn\u00e9es m\u00e9triques, nous utilisons Cadvisor. Sur les autres machines, nous utilisons process-exporter.<\/p>\n<p><\/p>\n<h2 id=\"sistemnye-servisy-stek-po\">Services syst\u00e8me, stack logiciel<\/h2>\n<p><\/p>\n<p>Chaque application a sa propre sp\u00e9cificit\u00e9, et il est difficile de distinguer un ensemble de m\u00e9triques particulier.<\/p>\n<p><\/p>\n<p>L'ensemble universel est :<\/p>\n<p><\/p>\n<ul>\n<li>le taux de requ\u00eates ;<\/li>\n<li>le nombre d'erreurs ;<\/li>\n<li>la latence ;<\/li>\n<li>saturation.<\/li>\n<\/ul>\n<p><\/p>\n<p>Les exemples les plus marquants de ce niveau de surveillance chez nous sont Nginx et PostgreSQL.<\/p>\n<p><\/p>\n<p>Le service le plus charg\u00e9 dans notre syst\u00e8me est la base de donn\u00e9es. Auparavant, nous avions souvent des probl\u00e8mes pour comprendre ce que faisait la base de donn\u00e9es.<\/p>\n<p><\/p>\n<p>Nous avons observ\u00e9 une forte charge sur les disques, mais les slow logs ne montraient rien de significatif. Nous avons r\u00e9solu ce probl\u00e8me gr\u00e2ce \u00e0 pg_stat_statements, une vue qui compile les statistiques sur les requ\u00eates.<\/p>\n<p><\/p>\n<p>C'est tout ce dont un admin a besoin.<\/p>\n<p><\/p>\n<p>Nous construisons des graphiques d'activit\u00e9 des requ\u00eates en lecture et en \u00e9criture :<\/p>\n<p>\n<img decoding=\"async\" alt=\"Comment nous avons construit la surveillance sur Prometheus, Clickhouse et ELK\" src=\"\/wp-content\/uploads\/2019\/04\/f838b7759221b284c06941291fa186df.png\" style=\"display:block;margin: 0 auto;\" \/><br \/>\n<img decoding=\"async\" alt=\"Comment nous avons construit la surveillance sur Prometheus, Clickhouse et ELK\" src=\"\/wp-content\/uploads\/2019\/04\/ea8684ea81f21c8d762a606aeb8342a3.png\" style=\"display:block;margin: 0 auto;\" \/><\/p>\n<p>Tout est simple et clair, chaque requ\u00eate a sa couleur.<\/p>\n<p><\/p>\n<p>Un autre exemple marquant \u2014 les logs Nginx. Il n'est pas surprenant que peu de gens les analysent ou les mentionnent dans la liste des incontournables. Le format standard n'est pas tr\u00e8s informatif et doit \u00eatre \u00e9tendu.<\/p>\n<p><\/p>\n<p>Personnellement, j'ai ajout\u00e9 request_time, upstream_response_time, body_bytes_sent, request_length, request_id. Nous construisons des graphiques du temps de r\u00e9ponse et du nombre d'erreurs :<\/p>\n<p>\n<img decoding=\"async\" alt=\"Comment nous avons construit la surveillance sur Prometheus, Clickhouse et ELK\" src=\"\/wp-content\/uploads\/2019\/04\/e517f15303f8fa780d40b7f7e30eb9ef.png\" style=\"display:block;margin: 0 auto;\" \/><br \/>\n<img decoding=\"async\" alt=\"Comment nous avons construit la surveillance sur Prometheus, Clickhouse et ELK\" src=\"\/wp-content\/uploads\/2019\/04\/9a07ffda75300ec939edff24532fc294.png\" style=\"display:block;margin: 0 auto;\" \/><\/p>\n<p>Nous construisons des graphiques du temps de r\u00e9ponse et du nombre d'erreurs. Vous vous souvenez ? Je parlais des enjeux de l'entreprise ? Pour \u00eatre rapide et sans erreurs ? Nous avons d\u00e9j\u00e0 r\u00e9solu ces questions avec deux graphiques. Et \u00e0 partir d'eux, nous pouvons d\u00e9j\u00e0 appeler les administrateurs de garde.<\/p>\n<p><\/p>\n<p>Mais il reste un probl\u00e8me \u2014 assurer une r\u00e9solution rapide des causes de l'incident.<\/p>\n<p><\/p>\n<h2 id=\"ustranenie-incidentov\">R\u00e9solution des incidents<\/h2>\n<p><\/p>\n<p>Tout le processus, de l'identification \u00e0 la r\u00e9solution du probl\u00e8me, peut \u00eatre divis\u00e9 en plusieurs \u00e9tapes :<\/p>\n<p><\/p>\n<ul>\n<li>identification du probl\u00e8me ;<\/li>\n<li>notification de l'administrateur de garde ;<\/li>\n<li>r\u00e9action \u00e0 l'incident ;<\/li>\n<li>\u00e9limination des causes.<\/li>\n<\/ul>\n<p><\/p>\n<p>Il est important que nous le fassions le plus rapidement possible. Et si nous ne pouvons pas gagner de temps aux \u00e9tapes d'identification du probl\u00e8me et d'envoi de notifications \u2014 deux minutes y vont de toute fa\u00e7on, alors les \u00e9tapes suivantes sont simplement un vaste champ d'am\u00e9liorations.<\/p>\n<p><\/p>\n<p>Imaginons simplement que le t\u00e9l\u00e9phone du personne de garde sonne. Que va-t-il faire ? Chercher des r\u00e9ponses aux questions - qu'est-ce qui est cass\u00e9, o\u00f9 cela s'est-il produit, comment r\u00e9agir ? Voici comment nous r\u00e9pondons \u00e0 ces questions :<\/p>\n<p>\n<img decoding=\"async\" alt=\"Comment nous avons construit la surveillance sur Prometheus, Clickhouse et ELK\" src=\"\/wp-content\/uploads\/2019\/04\/7f33172922e646a24bb83733350b24f5.png\" style=\"display:block;margin: 0 auto;\" \/><\/p>\n<p>Nous incluons simplement toutes ces informations dans le texte de la notification, en y ajoutant un lien vers la page Wiki qui d\u00e9crit comment r\u00e9agir \u00e0 ce probl\u00e8me, comment le r\u00e9soudre et le transmettre.<\/p>\n<p><\/p>\n<p>Je n'ai toujours rien dit sur le niveau de l'application et la logique m\u00e9tier. Malheureusement, nos applications n'ont pas encore mis en place la collecte de m\u00e9triques. La seule source d'informations, m\u00eame partielles, \u00e0 ces niveaux - ce sont les journaux.<\/p>\n<p><\/p>\n<p>Quelques points.<\/p>\n<p><\/p>\n<p>Premi\u00e8rement, \u00e9crivez des journaux structur\u00e9s. Ne mettez pas le contexte dans le texte du message. Cela complique leur regroupement et leur analyse. Logstash n\u00e9cessite beaucoup de temps pour normaliser tout cela.<\/p>\n<p><\/p>\n<p>Deuxi\u00e8mement, utilisez correctement les niveaux de gravit\u00e9. Chaque langage a sa propre norme. Personnellement, je distingue quatre niveaux :<\/p>\n<p><\/p>\n<ol>\n<li>pas d'erreur;<\/li>\n<li>erreur c\u00f4t\u00e9 client;<\/li>\n<li>erreur de notre c\u00f4t\u00e9, nous ne perdons pas d'argent, nous ne prenons pas de risques;<\/li>\n<li>erreur de notre c\u00f4t\u00e9, nous perdons de l'argent.<\/li>\n<\/ol>\n<p><\/p>\n<p>En r\u00e9sum\u00e9. Nous devons nous efforcer de construire le monitoring en fonction de la logique m\u00e9tier. Essayer de monitorer l'application elle-m\u00eame et de travailler avec des m\u00e9triques telles que le nombre de ventes, le nombre de nouvelles inscriptions d'utilisateurs, le nombre d'utilisateurs actifs \u00e0 ce moment-l\u00e0, etc.<\/p>\n<p><\/p>\n<p>Si votre entreprise est simplement un bouton dans un navigateur, il est n\u00e9cessaire de surveiller si celui-ci est cliqu\u00e9 et fonctionne correctement. Tout le reste n'est pas important.<\/p>\n<p><\/p>\n<p>Si vous ne l'avez pas, vous pouvez essayer de le rattraper dans les journaux de l'application, les journaux Nginx, etc., comme nous l'avons fait. Vous devez \u00eatre aussi proche de l'application que possible.<\/p>\n<p><\/p>\n<p>Les m\u00e9triques du syst\u00e8me d'exploitation sont bien s\u00fbr importantes, mais elles n'int\u00e9ressent pas le business, nous ne sommes pas pay\u00e9s pour elles.<\/p>\n<p>Source : <a content=\"nofollow\" rel=\"nofollow\" href=\"https:\/\/habr.com\/ru\/post\/449352\/\">habr.com<\/a><\/p>","protected":false,"gt_translate_keys":[{"key":"rendered","format":"html"}]},"excerpt":{"rendered":"<p>\u041c\u0435\u043d\u044f \u0437\u043e\u0432\u0443\u0442 \u0410\u043d\u0442\u043e\u043d \u0411\u0430\u0434\u0435\u0440\u0438\u043d. \u042f \u0440\u0430\u0431\u043e\u0442\u0430\u044e \u0432 \u0426\u0435\u043d\u0442\u0440\u0435 \u0412\u044b\u0441\u043e\u043a\u0438\u0445 \u0422\u0435\u0445\u043d\u043e\u043b\u043e\u0433\u0438\u0439 \u0438 \u0437\u0430\u043d\u0438\u043c\u0430\u044e\u0441\u044c \u0441\u0438\u0441\u0442\u0435\u043c\u043d\u044b\u043c \u0430\u0434\u043c\u0438\u043d\u0438\u0441\u0442\u0440\u0438\u0440\u043e\u0432\u0430\u043d\u0438\u0435\u043c. \u041c\u0435\u0441\u044f\u0446 \u043d\u0430\u0437\u0430\u0434 \u0437\u0430\u0432\u0435\u0440\u0448\u0438\u043b\u0430\u0441\u044c \u043d\u0430\u0448\u0430 \u043a\u043e\u0440\u043f\u043e\u0440\u0430\u0442\u0438\u0432\u043d\u0430\u044f \u043a\u043e\u043d\u0444\u0435\u0440\u0435\u043d\u0446\u0438\u044f, \u0433\u0434\u0435 \u043c\u044b \u0434\u0435\u043b\u0438\u043b\u0438\u0441\u044c \u043d\u0430\u043a\u043e\u043f\u043b\u0435\u043d\u043d\u044b\u043c \u043e\u043f\u044b\u0442\u043e\u043c \u0441 IT-\u0441\u043e\u043e\u0431\u0449\u0435\u0441\u0442\u0432\u043e\u043c \u043d\u0430\u0448\u0435\u0433\u043e \u0433\u043e\u0440\u043e\u0434\u0430. \u042f \u0440\u0430\u0441\u0441\u043a\u0430\u0437\u044b\u0432\u0430\u043b \u043f\u0440\u043e \u043c\u043e\u043d\u0438\u0442\u043e\u0440\u0438\u043d\u0433 \u0432\u0435\u0431-\u043f\u0440\u0438\u043b\u043e\u0436\u0435\u043d\u0438\u0439. \u041c\u0430\u0442\u0435\u0440\u0438\u0430\u043b \u043f\u0440\u0435\u0434\u043d\u0430\u0437\u043d\u0430\u0447\u0430\u043b\u0441\u044f \u0434\u043b\u044f \u0443\u0440\u043e\u0432\u043d\u044f junior \u0438\u043b\u0438 middle, \u043a\u043e\u0442\u043e\u0440\u044b\u0435 \u043d\u0435 \u0432\u044b\u0441\u0442\u0440\u0430\u0438\u0432\u0430\u043b\u0438 \u044d\u0442\u043e\u0442 \u043f\u0440\u043e\u0446\u0435\u0441\u0441 \u0441 \u043d\u0443\u043b\u044f. \u041a\u0440\u0430\u0435\u0443\u0433\u043e\u043b\u044c\u043d\u044b\u0439 \u043a\u0430\u043c\u0435\u043d\u044c, \u043b\u0435\u0436\u0430\u0449\u0438\u0439 \u0432 \u043e\u0441\u043d\u043e\u0432\u0435 \u043b\u044e\u0431\u043e\u0439 \u0441\u0438\u0441\u0442\u0435\u043c\u044b [&hellip;]<\/p>\n","protected":false,"gt_translate_keys":[{"key":"rendered","format":"html"}]},"author":1,"featured_media":24139,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[688],"tags":[],"class_list":["post-32322","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-administrirovanie"],"aioseo_notices":[],"aioseo_head":"\n\t\t<!-- All in One SEO 5.0.2 - aioseo.com -->\n\t<meta name=\"description\" content=\"\u041c\u0435\u043d\u044f \u0437\u043e\u0432\u0443\u0442 \u0410\u043d\u0442\u043e\u043d \u0411\u0430\u0434\u0435\u0440\u0438\u043d. \u042f \u0440\u0430\u0431\u043e\u0442\u0430\u044e \u0432 \u0426\u0435\u043d\u0442\u0440\u0435 \u0412\u044b\u0441\u043e\u043a\u0438\u0445 \u0422\u0435\u0445\u043d\u043e\u043b\u043e\u0433\u0438\u0439 \u0438 \u0437\u0430\u043d\u0438\u043c\u0430\u044e\u0441\u044c \u0441\u0438\u0441\u0442\u0435\u043c\u043d\u044b\u043c \u0430\u0434\u043c\u0438\u043d\u0438\u0441\u0442\u0440\u0438\u0440\u043e\u0432\u0430\u043d\u0438\u0435\u043c.\" \/>\n\t<meta name=\"robots\" content=\"max-image-preview:large\" \/>\n\t<meta name=\"author\" content=\"Yuri Gagarin\"\/>\n\t<link rel=\"canonical\" href=\"https:\/\/prohoster.info\/fr\/blog\/administrirovanie\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk\" \/>\n\t<meta name=\"generator\" content=\"All in One SEO (AIOSEO) 5.0.2\" \/>\n\t\t<meta property=\"og:locale\" content=\"fr_FR\" \/>\n\t\t<meta property=\"og:site_name\" content=\"ProHoster | \u041a\u0443\u043f\u0438\u0442\u044c \u043d\u0430\u0434\u0435\u0436\u043d\u044b\u0439 \u0445\u043e\u0441\u0442\u0438\u043d\u0433 \u0434\u043b\u044f \u0441\u0430\u0439\u0442\u043e\u0432 \u0441 \u0437\u0430\u0449\u0438\u0442\u043e\u0439 \u043e\u0442 DDoS, VPS VDS \u0441\u0435\u0440\u0432\u0435\u0440\u044b\" \/>\n\t\t<meta property=\"og:type\" content=\"article\" \/>\n\t\t<meta property=\"og:title\" content=\"\ud83e\udd47\u041a\u0430\u043a \u043c\u044b \u0441\u0442\u0440\u043e\u0438\u043b\u0438 \u043c\u043e\u043d\u0438\u0442\u043e\u0440\u0438\u043d\u0433 \u043d\u0430 Prometheus, Clickhouse \u0438 ELK | ProHoster\" \/>\n\t\t<meta property=\"og:description\" content=\"\u041c\u0435\u043d\u044f \u0437\u043e\u0432\u0443\u0442 \u0410\u043d\u0442\u043e\u043d \u0411\u0430\u0434\u0435\u0440\u0438\u043d. \u042f \u0440\u0430\u0431\u043e\u0442\u0430\u044e \u0432 \u0426\u0435\u043d\u0442\u0440\u0435 \u0412\u044b\u0441\u043e\u043a\u0438\u0445 \u0422\u0435\u0445\u043d\u043e\u043b\u043e\u0433\u0438\u0439 \u0438 \u0437\u0430\u043d\u0438\u043c\u0430\u044e\u0441\u044c \u0441\u0438\u0441\u0442\u0435\u043c\u043d\u044b\u043c \u0430\u0434\u043c\u0438\u043d\u0438\u0441\u0442\u0440\u0438\u0440\u043e\u0432\u0430\u043d\u0438\u0435\u043c.\" \/>\n\t\t<meta property=\"og:url\" content=\"https:\/\/prohoster.info\/fr\/blog\/administrirovanie\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk\" \/>\n\t\t<meta property=\"og:image\" content=\"https:\/\/prohoster.info\/wp-content\/uploads\/2021\/11\/logo-350.jpg\" \/>\n\t\t<meta property=\"og:image:secure_url\" content=\"https:\/\/prohoster.info\/wp-content\/uploads\/2021\/11\/logo-350.jpg\" \/>\n\t\t<meta property=\"og:image:width\" content=\"350\" \/>\n\t\t<meta property=\"og:image:height\" content=\"350\" \/>\n\t\t<meta property=\"article:published_time\" content=\"2019-10-31T18:46:21+00:00\" \/>\n\t\t<meta property=\"article:modified_time\" content=\"2019-10-31T18:46:21+00:00\" \/>\n\t\t<meta property=\"article:publisher\" content=\"https:\/\/www.facebook.com\/prohoster\" \/>\n\t\t<meta property=\"article:author\" content=\"https:\/\/www.facebook.com\/prohoster\" \/>\n\t\t<!-- All in One SEO -->\n\n","aioseo_head_json":{"title":"\ud83e\udd47Comment nous avons construit le monitoring avec Prometheus, Clickhouse et ELK | ProHoster","description":"Je m'appelle Anton Baderin. Je travaille au Centre des Hautes Technologies et je suis administrateur syst\u00e8me.","canonical_url":"https:\/\/prohoster.info\/fr\/blog\/administrirovanie\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk","robots":"max-image-preview:large","keywords":"","webmasterTools":{"miscellaneous":""},"schema":null,"og:locale":"fr_FR","og:site_name":"ProHoster | \u041a\u0443\u043f\u0438\u0442\u044c \u043d\u0430\u0434\u0435\u0436\u043d\u044b\u0439 \u0445\u043e\u0441\u0442\u0438\u043d\u0433 \u0434\u043b\u044f \u0441\u0430\u0439\u0442\u043e\u0432 \u0441 \u0437\u0430\u0449\u0438\u0442\u043e\u0439 \u043e\u0442 DDoS, VPS VDS \u0441\u0435\u0440\u0432\u0435\u0440\u044b","og:type":"article","og:title":"\ud83e\udd47\u041a\u0430\u043a \u043c\u044b \u0441\u0442\u0440\u043e\u0438\u043b\u0438 \u043c\u043e\u043d\u0438\u0442\u043e\u0440\u0438\u043d\u0433 \u043d\u0430 Prometheus, Clickhouse \u0438 ELK | ProHoster","og:description":"\u041c\u0435\u043d\u044f \u0437\u043e\u0432\u0443\u0442 \u0410\u043d\u0442\u043e\u043d \u0411\u0430\u0434\u0435\u0440\u0438\u043d. \u042f \u0440\u0430\u0431\u043e\u0442\u0430\u044e \u0432 \u0426\u0435\u043d\u0442\u0440\u0435 \u0412\u044b\u0441\u043e\u043a\u0438\u0445 \u0422\u0435\u0445\u043d\u043e\u043b\u043e\u0433\u0438\u0439 \u0438 \u0437\u0430\u043d\u0438\u043c\u0430\u044e\u0441\u044c \u0441\u0438\u0441\u0442\u0435\u043c\u043d\u044b\u043c \u0430\u0434\u043c\u0438\u043d\u0438\u0441\u0442\u0440\u0438\u0440\u043e\u0432\u0430\u043d\u0438\u0435\u043c.","og:url":"https:\/\/prohoster.info\/fr\/blog\/administrirovanie\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk","og:image":"https:\/\/prohoster.info\/wp-content\/uploads\/2021\/11\/logo-350.jpg","og:image:secure_url":"https:\/\/prohoster.info\/wp-content\/uploads\/2021\/11\/logo-350.jpg","og:image:width":350,"og:image:height":350,"article:published_time":"2019-10-31T18:46:21+00:00","article:modified_time":"2019-10-31T18:46:21+00:00","article:publisher":"https:\/\/www.facebook.com\/prohoster","article:author":"https:\/\/www.facebook.com\/prohoster"},"aioseo_meta_data":{"post_id":"32322","title":null,"description":null,"keywords":null,"keyphrases":null,"primary_term":null,"canonical_url":null,"og_title":null,"og_description":null,"og_object_type":"default","og_image_type":"default","og_image_url":null,"og_image_width":null,"og_image_height":null,"og_image_custom_url":null,"og_image_custom_fields":null,"og_video":null,"og_custom_url":null,"og_article_section":null,"og_article_tags":null,"twitter_use_og":false,"twitter_card":"default","twitter_image_type":"default","twitter_image_url":null,"twitter_image_custom_url":null,"twitter_image_custom_fields":null,"twitter_title":null,"twitter_description":null,"schema":{"blockGraphs":[],"customGraphs":[],"default":{"data":{"Article":[],"Course":[],"Dataset":[],"FAQPage":[],"Movie":[],"Person":[],"Product":[],"ProductReview":[],"Car":[],"Recipe":[],"Service":[],"SoftwareApplication":[],"WebPage":[]},"graphName":"","isEnabled":true},"graphs":[]},"schema_type":null,"schema_type_options":null,"pillar_content":false,"robots_default":true,"robots_noindex":false,"robots_noarchive":false,"robots_nosnippet":false,"robots_nofollow":false,"robots_noimageindex":false,"robots_noodp":false,"robots_notranslate":false,"robots_max_snippet":null,"robots_max_videopreview":null,"robots_max_imagepreview":"large","priority":null,"frequency":null,"local_seo":null,"seo_analyzer_scan_date":"2026-02-22 15:34:41","breadcrumb_settings":null,"limit_modified_date":false,"reviewed_by":null,"ai":null,"created":"2021-03-01 03:00:23","updated":"2026-02-22 15:34:41","focus_keyword":null,"additional_keywords":null,"truseo_locale":null},"gt_translate_keys":[{"key":"link","format":"url"}],"_links":{"self":[{"href":"https:\/\/prohoster.info\/fr\/wp-json\/wp\/v2\/posts\/32322","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/prohoster.info\/fr\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/prohoster.info\/fr\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/prohoster.info\/fr\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/prohoster.info\/fr\/wp-json\/wp\/v2\/comments?post=32322"}],"version-history":[{"count":2,"href":"https:\/\/prohoster.info\/fr\/wp-json\/wp\/v2\/posts\/32322\/revisions"}],"predecessor-version":[{"id":162019,"href":"https:\/\/prohoster.info\/fr\/wp-json\/wp\/v2\/posts\/32322\/revisions\/162019"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/prohoster.info\/fr\/wp-json\/wp\/v2\/media\/24139"}],"wp:attachment":[{"href":"https:\/\/prohoster.info\/fr\/wp-json\/wp\/v2\/media?parent=32322"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/prohoster.info\/fr\/wp-json\/wp\/v2\/categories?post=32322"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/prohoster.info\/fr\/wp-json\/wp\/v2\/tags?post=32322"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}