{"id":32322,"date":"2019-10-31T21:46:21","date_gmt":"2019-10-31T18:46:21","guid":{"rendered":"https:\/\/prohoster.info\/blog\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk\/"},"modified":"2019-10-31T21:46:21","modified_gmt":"2019-10-31T18:46:21","slug":"kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk","status":"publish","type":"post","link":"https:\/\/prohoster.info\/de\/blog\/administrirovanie\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk","title":{"rendered":"Wie wir das Monitoring mit Prometheus, Clickhouse und ELK aufgebaut haben","gt_translate_keys":[{"key":"rendered","format":"text"}]},"content":{"rendered":"<p>Ich hei\u00dfe Anton Baderin. Ich arbeite im Zentrum f\u00fcr Hochtechnologie und bin f\u00fcr Systemadministration zust\u00e4ndig. Vor einem Monat fand unsere Firmenkonferenz statt, auf der wir unsere Erfahrungen mit der IT-Community unserer Stadt teilten. Ich sprach \u00fcber das Monitoring von Webanwendungen. Das Material war f\u00fcr Junior- oder Middle-Level gedacht, die diesen Prozess nicht von Grund auf neu aufgebaut haben.<\/p>\n<p><\/p>\n<p><img decoding=\"async\" alt=\"Wie wir das Monitoring mit Prometheus, Clickhouse und ELK aufgebaut haben\" src=\"\/wp-content\/uploads\/2019\/04\/c181509e6a10dd7562f361f328446d61.png\" style=\"display:block;margin: 0 auto;\" \/><\/p>\n<p><\/p>\n<p>Der Grundpfeiler, auf dem jede Monitoring-L\u00f6sung basiert, sind die Anforderungen des Gesch\u00e4fts. Monitoring nur um des Monitorings willen interessiert niemanden. Was will das Gesch\u00e4ft? Dass alles schnell und fehlerfrei funktioniert. Das Gesch\u00e4ft verlangt Proaktivit\u00e4t, dass wir selbst Probleme im Betrieb des Dienstes erkennen und sie so schnell wie m\u00f6glich beheben. Das sind im Wesentlichen die Aufgaben, die ich im vergangenen Jahr im Projekt eines unserer Kunden gel\u00f6st habe.<\/p>\n<p><noindex><a rel=\"nofollow\" name=\"habracut\"><\/a><\/noindex><\/p>\n<h2 id=\"o-proekte\">\u00dcber das Projekt<\/h2>\n<p><\/p>\n<p>Das Projekt ist eines der gr\u00f6\u00dften Loyalit\u00e4tsprogramme im Land. Wir helfen Einzelhandelsketten, die Verkaufsfrequenz durch verschiedene Marketinginstrumente wie Bonuskarten zu steigern. Insgesamt umfasst das Projekt 14 Anwendungen, die auf zehn Servern laufen.<\/p>\n<p><\/p>\n<p>W\u00e4hrend ich Interviews f\u00fchrte, habe ich mehrmals bemerkt, dass Administratoren nicht immer richtig an das Monitoring von Webanwendungen herangehen: Viele beschr\u00e4nken sich nach wie vor auf die Kennzahlen des Betriebssystems und \u00fcberwachen sporadisch die Dienste.<\/p>\n<p><\/p>\n<p>In meinem Fall basierte das Monitoring-System des Kunden zuvor auf Icinga. Es konnte die oben genannten Aufgaben nicht l\u00f6sen. Oft informierte der Kunde selbst uns \u00fcber Probleme, und nicht selten fehlten uns einfach die Daten, um die Ursache herauszufinden.<\/p>\n<p><\/p>\n<p>Dar\u00fcber hinaus war das klare Verst\u00e4ndnis der Aussichtslosigkeit ihrer weiteren Entwicklung vorhanden. Ich denke, diejenigen, die mit Icinga vertraut sind, werden mich verstehen. Also haben wir beschlossen, das Monitoring-System f\u00fcr Webanwendungen im Projekt vollst\u00e4ndig neu zu \u00fcberarbeiten.<\/p>\n<p><\/p>\n<h2 id=\"prometheus\">Prometheus<\/h2>\n<p><\/p>\n<p>Wir w\u00e4hlten Prometheus basierend auf drei Hauptkriterien:<\/p>\n<p><\/p>\n<ol>\n<li>Eine enorme Anzahl verf\u00fcgbarer Metriken. In unserem Fall sind es 60.000. Nat\u00fcrlich ist zu beachten, dass die \u00fcberwiegende Mehrheit von ihnen nicht verwendet wird (wahrscheinlich etwa 95 %). Auf der anderen Seite sind sie alle relativ g\u00fcnstig. Diese andere Extreme ist im Vergleich zu dem zuvor verwendeten Icinga. Dort war das Hinzuf\u00fcgen von Metriken besonders schmerzhaft: Die vorhandenen waren teuer (man muss sich nur den Quellcode eines beliebigen Plugins ansehen). Jedes Plugin war ein Bash- oder Python-Skript, dessen Ausf\u00fchrung ressourcenintensiv war.<\/li>\n<li>Dieses System verbraucht relativ wenig Ressourcen. F\u00fcr all unsere Metriken reichen 600 MB RAM, 15 % eines Kerns und ein paar Dutzend IOPS. Nat\u00fcrlich m\u00fcssen Metrik-Exporter gestartet werden, aber alle sind in Go geschrieben und sind ebenfalls nicht ressourcenhungrig. Ich glaube nicht, dass dies in der heutigen Zeit ein Problem ist. <\/li>\n<li>Erm\u00f6glicht den \u00dcbergang zu Kubernetes. Angesichts der Pl\u00e4ne des Auftraggebers ist die Wahl offensichtlich. <\/li>\n<\/ol>\n<p><\/p>\n<h2 id=\"elk\">ELK<\/h2>\n<p><\/p>\n<p>Fr\u00fcher haben wir keine Protokolle gesammelt und verarbeitet. Die Nachteile sind allen klar. Wir haben uns f\u00fcr ELK entschieden, da wir bereits Erfahrung mit diesem System hatten. Wir speichern dort nur die Protokolle der Anwendungen. Die Hauptkriterien f\u00fcr die Auswahl waren Volltextsuchen und deren Geschwindigkeit.<\/p>\n<p><\/p>\n<h2 id=\"slickhouse\">Clickhouse<\/h2>\n<p><\/p>\n<p>Urspr\u00fcnglich fiel die Wahl auf InfluxDB. Wir waren uns der Notwendigkeit bewusst, Protokolle von Nginx zu sammeln, Statistiken aus pg_stat_statements zu erfassen und historische Daten von Prometheus zu speichern. Influx hat uns nicht gefallen, da es gelegentlich viel Speicher verbrauchte und abst\u00fcrzte. Au\u00dferdem wollten wir Anfragen nach remote_addr gruppieren, aber die Gruppierung in diesem DBMS ist nur nach Tags m\u00f6glich. Tags sind teuer (Speicher), ihre Anzahl ist bedingt begrenzt.<\/p>\n<p><\/p>\n<p>Wir haben die Suche neu begonnen. Wir ben\u00f6tigten eine analytische Basis mit minimalem Ressourcenverbrauch, vorzugsweise mit Datensicherung auf der Festplatte.<\/p>\n<p><\/p>\n<p>Clickhouse erf\u00fcllt all diese Kriterien, und wir haben die Wahl niemals bereut. Wir schreiben keine herausragenden Datenmengen hinein (die Anzahl der Einf\u00fcgungen betr\u00e4gt nur etwa f\u00fcnf Tausend pro Minute).<\/p>\n<p><\/p>\n<h2 id=\"newrelic\">NewRelic<\/h2>\n<p><\/p>\n<p>NewRelic war historisch gesehen immer bei uns, da es die Wahl des Auftraggebers war. Es wird bei uns als APM eingesetzt.<\/p>\n<p><\/p>\n<h2 id=\"zabbix\">Zabbix<\/h2>\n<p><\/p>\n<p>Wir verwenden Zabbix ausschlie\u00dflich zur \u00dcberwachung von Black Box verschiedener APIs.<\/p>\n<p><\/p>\n<h2 id=\"opredelenie-podhoda-k-monitoringu\">Definition des \u00dcberwachungsansatzes<\/h2>\n<p><\/p>\n<p>Wir wollten die Aufgabe dekonstruiert und dadurch den Ansatz zur \u00dcberwachung systematisieren.<\/p>\n<p><\/p>\n<p>Daf\u00fcr habe ich unser System in folgende Ebenen unterteilt:<\/p>\n<p><\/p>\n<ul>\n<li>\u201eHardware\u201c und VMS;<\/li>\n<li>Betriebssystem;<\/li>\n<li>Systemdienste, Software-Stack;<\/li>\n<li>Anwendung;<\/li>\n<li>Gesch\u00e4ftslogik.<\/li>\n<\/ul>\n<p><\/p>\n<p>Was den Ansatz so praktisch macht:<\/p>\n<p><\/p>\n<ul>\n<li>wir wissen, wer f\u00fcr die Funktion jeder dieser Ebenen verantwortlich ist und k\u00f6nnen daher Warnungen versenden;<\/li>\n<li>wir k\u00f6nnen die Struktur beim Unterdr\u00fccken von Warnungen nutzen \u2014 es w\u00e4re seltsam, eine Warnung \u00fcber die Nichterreichbarkeit einer Datenbank zu versenden, wenn die gesamte virtuelle Maschine nicht erreichbar ist.<\/li>\n<\/ul>\n<p><\/p>\n<p>Da unsere Aufgabe darin besteht, St\u00f6rungen im Betrieb des Systems zu identifizieren, m\u00fcssen wir auf jeder Ebene einen bestimmten Satz von Metriken definieren, auf die wir bei der Erstellung von Alarmierungsregeln achten sollten. Lassen Sie uns nun die Ebenen \u201eVMS\u201c, \u201eBetriebssystem\u201c und \u201eSystemdienste, Software-Stack\u201c durchgehen.<\/p>\n<p><\/p>\n<h2 id=\"virtualnye-mashiny\">Virtuelle Maschinen<\/h2>\n<p><\/p>\n<p><a class=\"wpil_keyword_link\" href=\"https:\/\/prohoster.info\/de\/\"   title=\"Hosting\" data-wpil-keyword-link=\"linked\"  data-wpil-monitor-id=\"2329\">Hosting<\/a> weist uns CPU, Festplatte, Speicher und Netzwerk zu. Bei den ersten beiden hatten wir Probleme. Also, die Metriken:<\/p>\n<p><\/p>\n<p>CPU gestohlene Zeit \u2014 wenn Sie eine virtuelle Maschine bei Amazon (z. B. t2.micro) kaufen, sollten Sie verstehen, dass Ihnen kein ganzes Prozessorkern zugewiesen wird, sondern nur ein Kontingent seiner Zeit. Und wenn Sie dieses \u00fcberschreiten, wird Ihnen die CPU entzogen.<\/p>\n<p><\/p>\n<p>Diese Metrik erlaubt es, solche Momente zu verfolgen und Entscheidungen zu treffen. Zum Beispiel, ob es notwendig ist, einen umfangreicheren Tarif zu w\u00e4hlen oder die Verarbeitung von Hintergrundaufgaben und API-Anfragen auf verschiedene <a class=\"wpil_keyword_link\" href=\"https:\/\/prohoster.info\/de\/server\/dts-los-angeles\/\"   title=\"Server\" data-wpil-keyword-link=\"linked\"  data-wpil-monitor-id=\"3493\">Server<\/a>.<\/p>\n<p><\/p>\n<p>IOPS + CPU iowait Zeit \u2014 aus irgendeinem Grund geben viele Cloud-Hosting-Anbieter nicht genug IOPS. Zudem ist ein Diagramm mit niedrigen IOPS f\u00fcr sie kein Argument. Daher sollten wir auch CPU iowait sammeln. Mit diesem Paar an Diagrammen \u2014 mit niedrigen IOPS und hoher E\/A-Wartezeit \u2014 kann man bereits mit dem Hosting-Anbieter sprechen und das Problem l\u00f6sen.<\/p>\n<p><\/p>\n<h2 id=\"operacionnaya-sistema\">Das Betriebssystem<\/h2>\n<p><\/p>\n<p>Metriken des Betriebssystems:<\/p>\n<p><\/p>\n<ul>\n<li>verf\u00fcgbare Speichermenge in %;<\/li>\n<li>Aktivit\u00e4t der Nutzung des Swaps: vmstat swapin, swapout;<\/li>\n<li>Anzahl verf\u00fcgbarer Inode und freien Speicherplatz im Dateisystem in %<\/li>\n<li>Durchschnittliche Auslastung;<\/li>\n<li>Anzahl der Verbindungen im Status tw;<\/li>\n<li>F\u00fcllstand der conntrack-Tabelle;<\/li>\n<li>Die Qualit\u00e4t des Netzwerks kann mit dem Tool ss und dem Paket iproute2 \u00fcberwacht werden \u2014 wir erhalten aus dessen Ausgabe den RTT-Wert der Verbindungen und gruppieren nach Zielport.<\/li>\n<\/ul>\n<p><\/p>\n<p>Auf der Ebene des Betriebssystems haben wir auch eine Entit\u00e4t wie Prozesse. Es ist wichtig, in dem System eine Reihe von Prozessen zu identifizieren, die eine wichtige Rolle in seinem Betrieb spielen. Wenn Sie beispielsweise mehrere pgpool haben, sollten Sie Informationen \u00fcber jeden von ihnen sammeln.<\/p>\n<p><\/p>\n<p>Die Sammlung von Metriken ist wie folgt:<\/p>\n<p><\/p>\n<ul>\n<li>CPU;<\/li>\n<li>Speicher ist in erster Linie resident;<\/li>\n<li>IO \u2014 vorzugsweise in IOPS;<\/li>\n<li>FileFd \u2014 offene und limitierte;<\/li>\n<li>wesentliche Seitenfehler \u2014 so k\u00f6nnen Sie verstehen, welcher Prozess gerade ausgelagert wird.<\/li>\n<\/ul>\n<p><\/p>\n<p>Die gesamte \u00dcberwachung haben wir in Docker implementiert, um Metrikdaten zu sammeln, verwenden wir Cadvisor. Auf anderen Maschinen setzen wir process-exporter ein.<\/p>\n<p><\/p>\n<h2 id=\"sistemnye-servisy-stek-po\">Systemdienste, Software-Stack<\/h2>\n<p><\/p>\n<p>Jede Anwendung hat ihre eigenen Besonderheiten, und es ist schwierig, eine bestimmte Metrikansammlung hervorzuheben.<\/p>\n<p><\/p>\n<p>Ein universelles Set sind:<\/p>\n<p><\/p>\n<ul>\n<li>Anfrage-Rate;<\/li>\n<li>Anzahl der Fehler;<\/li>\n<li>Latenz;<\/li>\n<li>S\u00e4ttigung.<\/li>\n<\/ul>\n<p><\/p>\n<p>Die auff\u00e4lligsten Beispiele f\u00fcr das Monitoring dieses Niveaus bei uns sind \u2014 Nginx und PostgreSQL.<\/p>\n<p><\/p>\n<p>Der am st\u00e4rksten belastete Dienst in unserem System ist die Datenbank. Fr\u00fcher hatten wir oft Schwierigkeiten herauszufinden, womit die Datenbank besch\u00e4ftigt war.<\/p>\n<p><\/p>\n<p>Wir haben eine hohe Belastung auf die Festplatten gesehen, aber die Slowlogs haben nichts Nennenswertes gezeigt. Dieses Problem haben wir mit Hilfe von pg_stat_statements gel\u00f6st, einer Sicht, in der Statistiken zu Anfragen gesammelt werden.<\/p>\n<p><\/p>\n<p>Das ist alles, was ein Administrator braucht.<\/p>\n<p><\/p>\n<p>Wir erstellen Grafiken zur Aktivit\u00e4t von Lese- und Schreibanfragen:<\/p>\n<p>\n<img decoding=\"async\" alt=\"Wie wir das Monitoring mit Prometheus, Clickhouse und ELK aufgebaut haben\" src=\"\/wp-content\/uploads\/2019\/04\/f838b7759221b284c06941291fa186df.png\" style=\"display:block;margin: 0 auto;\" \/><br \/>\n<img decoding=\"async\" alt=\"Wie wir das Monitoring mit Prometheus, Clickhouse und ELK aufgebaut haben\" src=\"\/wp-content\/uploads\/2019\/04\/ea8684ea81f21c8d762a606aeb8342a3.png\" style=\"display:block;margin: 0 auto;\" \/><\/p>\n<p>Alles ist einfach und verst\u00e4ndlich, jede Anfrage hat ihre eigene Farbe.<\/p>\n<p><\/p>\n<p>Ein nicht minder auff\u00e4lliges Beispiel sind die Nginx-Logs. Es ist nicht \u00fcberraschend, dass sie von den wenigsten geparst oder in die Liste der Notwendigkeiten aufgenommen werden. Das Standardformat ist nicht sehr informativ und muss erweitert werden.<\/p>\n<p><\/p>\n<p>Ich pers\u00f6nlich habe request_time, upstream_response_time, body_bytes_sent, request_length, request_id hinzugef\u00fcgt. Wir erstellen Grafiken zur Antwortzeit und zur Anzahl der Fehler:<\/p>\n<p>\n<img decoding=\"async\" alt=\"Wie wir das Monitoring mit Prometheus, Clickhouse und ELK aufgebaut haben\" src=\"\/wp-content\/uploads\/2019\/04\/e517f15303f8fa780d40b7f7e30eb9ef.png\" style=\"display:block;margin: 0 auto;\" \/><br \/>\n<img decoding=\"async\" alt=\"Wie wir das Monitoring mit Prometheus, Clickhouse und ELK aufgebaut haben\" src=\"\/wp-content\/uploads\/2019\/04\/9a07ffda75300ec939edff24532fc294.png\" style=\"display:block;margin: 0 auto;\" \/><\/p>\n<p>Wir erstellen Grafiken zur Antwortzeit und zur Anzahl der Fehler. Erinnern Sie sich? Ich sprach \u00fcber die Gesch\u00e4ftsanforderungen? Damit alles schnell und fehlerfrei ist? Mit diesen zwei Grafiken haben wir diese Fragen bereits gekl\u00e4rt. Und auf deren Basis k\u00f6nnen wir die diensthabenden Administratoren anrufen.<\/p>\n<p><\/p>\n<p>Aber es bleibt ein weiteres Problem \u2014 die schnelle Beseitigung der Ursachen des Vorfalls sicherzustellen.<\/p>\n<p><\/p>\n<h2 id=\"ustranenie-incidentov\">Vorfallbeseitigung<\/h2>\n<p><\/p>\n<p>Den gesamten Prozess von der Identifizierung bis zur Probleml\u00f6sung kann man in mehrere Schritte unterteilen:<\/p>\n<p><\/p>\n<ul>\n<li>Problemerkennung;<\/li>\n<li>Benachrichtigung des diensthabenden Administrators;<\/li>\n<li>Reaktion auf den Vorfall;<\/li>\n<li>Ursachenbeseitigung.<\/li>\n<\/ul>\n<p><\/p>\n<p>Es ist wichtig, dass wir dies so schnell wie m\u00f6glich tun. Und wenn wir in den Phasen der Problemerkennung und der Benachrichtigung nicht viel Zeit sparen k\u00f6nnen \u2014 zwei Minuten werden in jedem Fall ben\u00f6tigt \u2014 dann sind die nachfolgenden Phasen ein unerschlossenes Feld f\u00fcr Verbesserungen.<\/p>\n<p><\/p>\n<p>Lassen Sie uns einfach vorstellen, dass das Telefon des Bereitschaftsdienstes klingelt. Was wird er tun? Antworten auf die Fragen suchen \u2013 was ist kaputt, wo ist es kaputt, wie reagiert man? So beantworten wir diese Fragen:<\/p>\n<p>\n<img decoding=\"async\" alt=\"Wie wir das Monitoring mit Prometheus, Clickhouse und ELK aufgebaut haben\" src=\"\/wp-content\/uploads\/2019\/04\/7f33172922e646a24bb83733350b24f5.png\" style=\"display:block;margin: 0 auto;\" \/><\/p>\n<p>Wir integrieren einfach all diese Informationen in den Benachrichtigungstext und geben darin einen Link zur Wiki-Seite an, auf der beschrieben wird, wie man auf dieses Problem reagiert, wie man es l\u00f6st und eskaliert.<\/p>\n<p><\/p>\n<p>Ich habe bisher nichts \u00fcber die Anwendungsebene und die Gesch\u00e4ftslogik gesagt. Leider ist in unseren Anwendungen die Erfassung von Metriken noch nicht implementiert. Die einzige Quelle f\u00fcr einige Informationen aus diesen Ebenen sind die Protokolle.<\/p>\n<p><\/p>\n<p>Ein paar Punkte.<\/p>\n<p><\/p>\n<p>Erstens, schreiben Sie strukturierte Protokolle. Es ist nicht n\u00f6tig, den Kontext in den Nachrichtentext einzubeziehen. Das erschwert deren Gruppierung und Analyse. Logstash ben\u00f6tigt viel Zeit, um das alles zu normalisieren.<\/p>\n<p><\/p>\n<p>Zweitens, verwenden Sie die Schweregrade korrekt. Jede Sprache hat ihren eigenen Standard. Ich unterscheide pers\u00f6nlich vier Ebenen:<\/p>\n<p><\/p>\n<ol>\n<li>keine Fehler;<\/li>\n<li>fehler auf der Client-Seite;<\/li>\n<li>Fehler auf unserer Seite, wir verlieren kein Geld und tragen kein Risiko;<\/li>\n<li>Fehler auf unserer Seite, wir verlieren Geld.<\/li>\n<\/ol>\n<p><\/p>\n<p>Zusammenfassend. Man sollte versuchen, das Monitoring genau von der Gesch\u00e4ftslogik aus aufzubauen. Versuchen Sie, die Anwendung selbst zu \u00fcberwachen und mit Metriken wie der Anzahl der Verk\u00e4ufe, der Anzahl neuer Benutzerregistrierungen, der Anzahl aktiver Benutzer zu operieren.<\/p>\n<p><\/p>\n<p>Wenn Ihr gesamtes Gesch\u00e4ft nur ein Button im Browser ist, m\u00fcssen Sie \u00fcberwachen, ob er gedr\u00fcckt wird und ob er richtig funktioniert. Alles andere ist unwichtig.<\/p>\n<p><\/p>\n<p>Wenn Sie das nicht haben, k\u00f6nnen Sie versuchen, dies in den Protokollen der Anwendung, den Nginx-Protokollen usw. nachzuholen, wie wir es getan haben. Sie sollten so nah wie m\u00f6glich an der Anwendung sein.<\/p>\n<p><\/p>\n<p>Metriken des Betriebssystems sind nat\u00fcrlich wichtig, aber sie sind f\u00fcr das Gesch\u00e4ft nicht interessant, wir werden nicht daf\u00fcr bezahlt.<\/p>\n<p>Quelle: <a content=\"nofollow\" rel=\"nofollow\" href=\"https:\/\/habr.com\/ru\/post\/449352\/\">habr.com<\/a><\/p>","protected":false,"gt_translate_keys":[{"key":"rendered","format":"html"}]},"excerpt":{"rendered":"<p>\u041c\u0435\u043d\u044f \u0437\u043e\u0432\u0443\u0442 \u0410\u043d\u0442\u043e\u043d \u0411\u0430\u0434\u0435\u0440\u0438\u043d. \u042f \u0440\u0430\u0431\u043e\u0442\u0430\u044e \u0432 \u0426\u0435\u043d\u0442\u0440\u0435 \u0412\u044b\u0441\u043e\u043a\u0438\u0445 \u0422\u0435\u0445\u043d\u043e\u043b\u043e\u0433\u0438\u0439 \u0438 \u0437\u0430\u043d\u0438\u043c\u0430\u044e\u0441\u044c \u0441\u0438\u0441\u0442\u0435\u043c\u043d\u044b\u043c \u0430\u0434\u043c\u0438\u043d\u0438\u0441\u0442\u0440\u0438\u0440\u043e\u0432\u0430\u043d\u0438\u0435\u043c. \u041c\u0435\u0441\u044f\u0446 \u043d\u0430\u0437\u0430\u0434 \u0437\u0430\u0432\u0435\u0440\u0448\u0438\u043b\u0430\u0441\u044c \u043d\u0430\u0448\u0430 \u043a\u043e\u0440\u043f\u043e\u0440\u0430\u0442\u0438\u0432\u043d\u0430\u044f \u043a\u043e\u043d\u0444\u0435\u0440\u0435\u043d\u0446\u0438\u044f, \u0433\u0434\u0435 \u043c\u044b \u0434\u0435\u043b\u0438\u043b\u0438\u0441\u044c \u043d\u0430\u043a\u043e\u043f\u043b\u0435\u043d\u043d\u044b\u043c \u043e\u043f\u044b\u0442\u043e\u043c \u0441 IT-\u0441\u043e\u043e\u0431\u0449\u0435\u0441\u0442\u0432\u043e\u043c \u043d\u0430\u0448\u0435\u0433\u043e \u0433\u043e\u0440\u043e\u0434\u0430. \u042f \u0440\u0430\u0441\u0441\u043a\u0430\u0437\u044b\u0432\u0430\u043b \u043f\u0440\u043e \u043c\u043e\u043d\u0438\u0442\u043e\u0440\u0438\u043d\u0433 \u0432\u0435\u0431-\u043f\u0440\u0438\u043b\u043e\u0436\u0435\u043d\u0438\u0439. \u041c\u0430\u0442\u0435\u0440\u0438\u0430\u043b \u043f\u0440\u0435\u0434\u043d\u0430\u0437\u043d\u0430\u0447\u0430\u043b\u0441\u044f \u0434\u043b\u044f \u0443\u0440\u043e\u0432\u043d\u044f junior \u0438\u043b\u0438 middle, \u043a\u043e\u0442\u043e\u0440\u044b\u0435 \u043d\u0435 \u0432\u044b\u0441\u0442\u0440\u0430\u0438\u0432\u0430\u043b\u0438 \u044d\u0442\u043e\u0442 \u043f\u0440\u043e\u0446\u0435\u0441\u0441 \u0441 \u043d\u0443\u043b\u044f. \u041a\u0440\u0430\u0435\u0443\u0433\u043e\u043b\u044c\u043d\u044b\u0439 \u043a\u0430\u043c\u0435\u043d\u044c, \u043b\u0435\u0436\u0430\u0449\u0438\u0439 \u0432 \u043e\u0441\u043d\u043e\u0432\u0435 \u043b\u044e\u0431\u043e\u0439 \u0441\u0438\u0441\u0442\u0435\u043c\u044b [&hellip;]<\/p>\n","protected":false,"gt_translate_keys":[{"key":"rendered","format":"html"}]},"author":1,"featured_media":24139,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[688],"tags":[],"class_list":["post-32322","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-administrirovanie"],"aioseo_notices":[],"aioseo_head":"\n\t\t<!-- All in One SEO 5.0.1.1 - aioseo.com -->\n\t<meta name=\"description\" content=\"\u041c\u0435\u043d\u044f \u0437\u043e\u0432\u0443\u0442 \u0410\u043d\u0442\u043e\u043d \u0411\u0430\u0434\u0435\u0440\u0438\u043d. \u042f \u0440\u0430\u0431\u043e\u0442\u0430\u044e \u0432 \u0426\u0435\u043d\u0442\u0440\u0435 \u0412\u044b\u0441\u043e\u043a\u0438\u0445 \u0422\u0435\u0445\u043d\u043e\u043b\u043e\u0433\u0438\u0439 \u0438 \u0437\u0430\u043d\u0438\u043c\u0430\u044e\u0441\u044c \u0441\u0438\u0441\u0442\u0435\u043c\u043d\u044b\u043c \u0430\u0434\u043c\u0438\u043d\u0438\u0441\u0442\u0440\u0438\u0440\u043e\u0432\u0430\u043d\u0438\u0435\u043c.\" \/>\n\t<meta name=\"robots\" content=\"max-image-preview:large\" \/>\n\t<meta name=\"author\" content=\"Yuri Gagarin\"\/>\n\t<link rel=\"canonical\" href=\"https:\/\/prohoster.info\/de\/blog\/administrirovanie\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk\" \/>\n\t<meta name=\"generator\" content=\"All in One SEO (AIOSEO) 5.0.1.1\" \/>\n\t\t<meta property=\"og:locale\" content=\"de_DE\" \/>\n\t\t<meta property=\"og:site_name\" content=\"ProHoster | \u041a\u0443\u043f\u0438\u0442\u044c \u043d\u0430\u0434\u0435\u0436\u043d\u044b\u0439 \u0445\u043e\u0441\u0442\u0438\u043d\u0433 \u0434\u043b\u044f \u0441\u0430\u0439\u0442\u043e\u0432 \u0441 \u0437\u0430\u0449\u0438\u0442\u043e\u0439 \u043e\u0442 DDoS, VPS VDS \u0441\u0435\u0440\u0432\u0435\u0440\u044b\" \/>\n\t\t<meta property=\"og:type\" content=\"article\" \/>\n\t\t<meta property=\"og:title\" content=\"\ud83e\udd47\u041a\u0430\u043a \u043c\u044b \u0441\u0442\u0440\u043e\u0438\u043b\u0438 \u043c\u043e\u043d\u0438\u0442\u043e\u0440\u0438\u043d\u0433 \u043d\u0430 Prometheus, Clickhouse \u0438 ELK | ProHoster\" \/>\n\t\t<meta property=\"og:description\" content=\"\u041c\u0435\u043d\u044f \u0437\u043e\u0432\u0443\u0442 \u0410\u043d\u0442\u043e\u043d \u0411\u0430\u0434\u0435\u0440\u0438\u043d. \u042f \u0440\u0430\u0431\u043e\u0442\u0430\u044e \u0432 \u0426\u0435\u043d\u0442\u0440\u0435 \u0412\u044b\u0441\u043e\u043a\u0438\u0445 \u0422\u0435\u0445\u043d\u043e\u043b\u043e\u0433\u0438\u0439 \u0438 \u0437\u0430\u043d\u0438\u043c\u0430\u044e\u0441\u044c \u0441\u0438\u0441\u0442\u0435\u043c\u043d\u044b\u043c \u0430\u0434\u043c\u0438\u043d\u0438\u0441\u0442\u0440\u0438\u0440\u043e\u0432\u0430\u043d\u0438\u0435\u043c.\" \/>\n\t\t<meta property=\"og:url\" content=\"https:\/\/prohoster.info\/de\/blog\/administrirovanie\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk\" \/>\n\t\t<meta property=\"og:image\" content=\"https:\/\/prohoster.info\/wp-content\/uploads\/2021\/11\/logo-350.jpg\" \/>\n\t\t<meta property=\"og:image:secure_url\" content=\"https:\/\/prohoster.info\/wp-content\/uploads\/2021\/11\/logo-350.jpg\" \/>\n\t\t<meta property=\"og:image:width\" content=\"350\" \/>\n\t\t<meta property=\"og:image:height\" content=\"350\" \/>\n\t\t<meta property=\"article:published_time\" content=\"2019-10-31T18:46:21+00:00\" \/>\n\t\t<meta property=\"article:modified_time\" content=\"2019-10-31T18:46:21+00:00\" \/>\n\t\t<meta property=\"article:publisher\" content=\"https:\/\/www.facebook.com\/prohoster\" \/>\n\t\t<meta property=\"article:author\" content=\"https:\/\/www.facebook.com\/prohoster\" \/>\n\t\t<!-- All in One SEO -->\n\n","aioseo_head_json":{"title":"\ud83e\udd47Wie wir Monitoring mit Prometheus, Clickhouse und ELK aufbauten | ProHoster","description":"Ich hei\u00dfe Anton Baderin. Ich arbeite im Zentrum f\u00fcr Hochtechnologie und bin f\u00fcr die Systemadministration zust\u00e4ndig.","canonical_url":"https:\/\/prohoster.info\/de\/blog\/administrirovanie\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk","robots":"max-image-preview:large","keywords":"","webmasterTools":{"miscellaneous":""},"schema":null,"og:locale":"de_DE","og:site_name":"ProHoster | \u041a\u0443\u043f\u0438\u0442\u044c \u043d\u0430\u0434\u0435\u0436\u043d\u044b\u0439 \u0445\u043e\u0441\u0442\u0438\u043d\u0433 \u0434\u043b\u044f \u0441\u0430\u0439\u0442\u043e\u0432 \u0441 \u0437\u0430\u0449\u0438\u0442\u043e\u0439 \u043e\u0442 DDoS, VPS VDS \u0441\u0435\u0440\u0432\u0435\u0440\u044b","og:type":"article","og:title":"\ud83e\udd47\u041a\u0430\u043a \u043c\u044b \u0441\u0442\u0440\u043e\u0438\u043b\u0438 \u043c\u043e\u043d\u0438\u0442\u043e\u0440\u0438\u043d\u0433 \u043d\u0430 Prometheus, Clickhouse \u0438 ELK | ProHoster","og:description":"\u041c\u0435\u043d\u044f \u0437\u043e\u0432\u0443\u0442 \u0410\u043d\u0442\u043e\u043d \u0411\u0430\u0434\u0435\u0440\u0438\u043d. \u042f \u0440\u0430\u0431\u043e\u0442\u0430\u044e \u0432 \u0426\u0435\u043d\u0442\u0440\u0435 \u0412\u044b\u0441\u043e\u043a\u0438\u0445 \u0422\u0435\u0445\u043d\u043e\u043b\u043e\u0433\u0438\u0439 \u0438 \u0437\u0430\u043d\u0438\u043c\u0430\u044e\u0441\u044c \u0441\u0438\u0441\u0442\u0435\u043c\u043d\u044b\u043c \u0430\u0434\u043c\u0438\u043d\u0438\u0441\u0442\u0440\u0438\u0440\u043e\u0432\u0430\u043d\u0438\u0435\u043c.","og:url":"https:\/\/prohoster.info\/de\/blog\/administrirovanie\/kak-my-stroili-monitoring-na-prometheus-clickhouse-i-elk","og:image":"https:\/\/prohoster.info\/wp-content\/uploads\/2021\/11\/logo-350.jpg","og:image:secure_url":"https:\/\/prohoster.info\/wp-content\/uploads\/2021\/11\/logo-350.jpg","og:image:width":350,"og:image:height":350,"article:published_time":"2019-10-31T18:46:21+00:00","article:modified_time":"2019-10-31T18:46:21+00:00","article:publisher":"https:\/\/www.facebook.com\/prohoster","article:author":"https:\/\/www.facebook.com\/prohoster"},"aioseo_meta_data":{"post_id":"32322","title":null,"description":null,"keywords":null,"keyphrases":null,"primary_term":null,"canonical_url":null,"og_title":null,"og_description":null,"og_object_type":"default","og_image_type":"default","og_image_url":null,"og_image_width":null,"og_image_height":null,"og_image_custom_url":null,"og_image_custom_fields":null,"og_video":null,"og_custom_url":null,"og_article_section":null,"og_article_tags":null,"twitter_use_og":false,"twitter_card":"default","twitter_image_type":"default","twitter_image_url":null,"twitter_image_custom_url":null,"twitter_image_custom_fields":null,"twitter_title":null,"twitter_description":null,"schema":{"blockGraphs":[],"customGraphs":[],"default":{"data":{"Article":[],"Course":[],"Dataset":[],"FAQPage":[],"Movie":[],"Person":[],"Product":[],"ProductReview":[],"Car":[],"Recipe":[],"Service":[],"SoftwareApplication":[],"WebPage":[]},"graphName":"","isEnabled":true},"graphs":[]},"schema_type":null,"schema_type_options":null,"pillar_content":false,"robots_default":true,"robots_noindex":false,"robots_noarchive":false,"robots_nosnippet":false,"robots_nofollow":false,"robots_noimageindex":false,"robots_noodp":false,"robots_notranslate":false,"robots_max_snippet":null,"robots_max_videopreview":null,"robots_max_imagepreview":"large","priority":null,"frequency":null,"local_seo":null,"seo_analyzer_scan_date":"2026-02-22 15:34:41","breadcrumb_settings":null,"limit_modified_date":false,"reviewed_by":null,"ai":null,"created":"2021-03-01 03:00:23","updated":"2026-02-22 15:34:41","focus_keyword":null,"additional_keywords":null,"truseo_locale":null},"gt_translate_keys":[{"key":"link","format":"url"}],"_links":{"self":[{"href":"https:\/\/prohoster.info\/de\/wp-json\/wp\/v2\/posts\/32322","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/prohoster.info\/de\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/prohoster.info\/de\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/prohoster.info\/de\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/prohoster.info\/de\/wp-json\/wp\/v2\/comments?post=32322"}],"version-history":[{"count":2,"href":"https:\/\/prohoster.info\/de\/wp-json\/wp\/v2\/posts\/32322\/revisions"}],"predecessor-version":[{"id":162019,"href":"https:\/\/prohoster.info\/de\/wp-json\/wp\/v2\/posts\/32322\/revisions\/162019"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/prohoster.info\/de\/wp-json\/wp\/v2\/media\/24139"}],"wp:attachment":[{"href":"https:\/\/prohoster.info\/de\/wp-json\/wp\/v2\/media?parent=32322"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/prohoster.info\/de\/wp-json\/wp\/v2\/categories?post=32322"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/prohoster.info\/de\/wp-json\/wp\/v2\/tags?post=32322"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}