Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

We wrześniu Broadcom (dawniej CA) wydał nową wersję 20.2 swojego rozwiązania DX Operations Intelligence (DX OI). Na rynku produkt ten jest pozycjonowany jako kompleksowy system monitorowania. System jest zdolny do pozyskiwania i łączenia danych z systemów monitorowania różnych domen (sieć, infrastruktura, aplikacje, bazy danych) zarówno od CA, jak i od zewnętrznych dostawców, w tym rozwiązań open source (Zabbix, Prometheus i innych).

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Główną funkcją DX OI jest budowanie pełnoprawnego modelu zasobowo-usługowego (RSM) opartego na jednostkach konfiguracji (KĘ), które zasilają bazę inwentarzową podczas integracji z systemami zewnętrznymi. W DX OI wprowadzone są funkcje uczenia maszynowego i sztucznej inteligencji (ML i AI) na danych wpływających do platformy, co umożliwia ocenę/prognozowanie prawdopodobieństwa awarii danej KĘ oraz stopnia wpływu awarii na usługę biznesową, której podstawą jest konkretna KĘ. Ponadto, DX OI jest jedynym punktem zbierania zdarzeń monitorowania i, odpowiednio, integracji z systemem Service Desk, co stanowi niepodważalną zaletę użytkowania systemu w centralnych punktach monitorowania z dyżurującymi zmianami organizacji. W tym artykule szczegółowo opiszemy funkcjonalność systemu oraz zaprezentujemy interfejsy użytkownika i administratora.

Architektura rozwiązania DX OI

Platforma DX posiada architekturę mikroserwisową, jest instalowana i działa pod kontrolą Kubernetes lub OpenShift. Na następnym rysunku przedstawione są komponenty rozwiązania, które mogą być używane jako samodzielne narzędzia monitorowania lub mogą być zastąpione już istniejącymi systemami monitorowania o podobnych funkcjach (na rysunku znajdują się przykłady takich systemów) i następnie podłączone do systemu DX OI. Na schemacie poniżej:

  • Monitorowanie aplikacji mobilnych w DX App Experience Analytics;
  • Monitorowanie wydajności aplikacji w DX APM;
  • Monitorowanie infrastruktury w DX Infrastructure Manager;
  • Monitorowanie urządzeń sieciowych w DX NetOps Manager.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Komponenty DX działają pod zarządzaniem klastra Kubernetes i skalują się poprzez proste uruchomienie nowych PODów. Poniżej znajduje się schemat rozwiązania na wyższym poziomie.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Zarządzanie, skalowanie i aktualizacja platformy DX odbywa się w konsoli administracyjnej. Z jednej konsoli można zarządzać wieloma przedsiębiorstwami lub jednostkami biznesowymi w ramach firmy w architekturze wielotenantowej. W tym modelu każde przedsiębiorstwo może być konfigurowane indywidualnie jako najemca z własnym zestawem konfiguracji.

Konsola administracyjna to narzędzie internetowe do zarządzania operacjami i systemem, które zapewnia administratorom spójny, zintegrowany interfejs do wykonywania zadań zarządzania klastrem monitorowania.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Nowi najemcy dla jednostek biznesowych lub przedsiębiorstw w firmie są wdrażani w zaledwie kilka minut. To daje przewagę, jeśli chcesz mieć jedną zintegrowaną system monitorowania, ale jednocześnie różnicować obiekty monitorowania między działami na poziomie platformy (a nie praw dostępu).

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Modele usługowe i monitorowanie usług biznesowych

DX OI ma wbudowane mechanizmy do tworzenia usług i opracowywania klasycznych RCM z logicznym przypisaniem wpływu i wag między komponentami usługi. Dostępne są również mechanizmy eksportu RCM z zewnętrznej CMDB. Na poniższym rysunku znajduje się wbudowany edytor RCM (zwróć uwagę na wagi powiązań).

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

DX OI daje całościowy obraz kluczowych wskaźników funkcjonowania usług biznesowych lub IT z szczegółami, w tym dostępnością usług i prognozowaniem ryzyka awarii. Narzędzie może również dać pojęcie o wpływie problemów wydajności lub zmian w strukturze komponentów IT (aplikacji lub infrastruktury) na usługę biznesową. Na poniższym rysunku interaktywny pulpit nawigacyjny, wyświetlający stan wszystkich usług.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Przyjrzyjmy się szczegółom na przykładzie usługi Digital Banking. Po kliknięciu na nazwę usługi przechodzimy do szczegółowego RCM usługi. Widać, że status usługi Digital Banking zależy od stanu infrastrukturalnych i transakcyjnych podusług z różnymi wagami. Praca z wagami i ich wizualizacja to interesująca przewaga DX OI.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Topologia to ważny element operacyjnego monitorowania przedsiębiorstwa, pozwala operatorom i inżynierom analizować zależności między komponentami, znajdować przyczyny wyjściowe i wpływy.

DX OI Topology Viewer to usługa, która wykorzystuje dane topologiczne pochodzące z systemów monitorowania domen, zbierających dane bezpośrednio z obiektów monitorowania. Narzędzie służy do przeszukiwania kilku warstw przechowywania topologii i wyświetlania mapy relacji zależnych od kontekstu. Aby zbadać problemy, można przejść do problematycznej usługi Backend Banking i zobaczyć topologię oraz problematyczne komponenty. Można również analizować komunikaty alarmowe i metryki wydajności dla każdego komponentu.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Analizując komponenty transakcyjne Payments (transakcje użytkowników), możemy śledzić wartości KPI biznesowych, które są również brane pod uwagę przy obliczaniu statusu dostępności i zdrowia usługi. Przykład KPI biznesowych przedstawiono poniżej:

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Analityka zdarzeń (Alarm Analytics)

Algorytmiczne tłumienie szumów poprzez klastrowanie alarmów

Jedną z kluczowych funkcji DX OI w analizie zdarzeń jest klastrowanie. Mechanizm działa na wszystkich powiadomieniach, które trafiają do systemu, aby identyfikować wzorce na podstawie różnych kontekstów i grupować je. Te klastry są samo uczące się, nie wymagają ręcznej konfiguracji.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

W ten sposób klastrowanie pozwala użytkownikom łączyć i grupować ogromne liczby zdarzeń oraz analizować tylko te, które mają wspólny kontekst. Na przykład zestaw zdarzeń reprezentujących incydent wpływający na działanie aplikacji lub centrum przetwarzania danych. Sytuacje są tworzone przy użyciu algorytmów klastrowania opartych na uczeniu maszynowym, które wykorzystują do analizy korelację czasową, powiązania topologiczne i przetwarzanie języka naturalnego. Na poniższych rysunkach przedstawiono przykłady wizualizacji grup klastrów komunikatów, znanych jako Situations Alarms oraz Evidence Timeline, pokazujących główne parametry grupowania i proces redukcji liczby zdarzeń szumowych.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Analiza problemów źródłowych i korelacja awarii

W nowoczesnym środowisku hybrydowym transakcja użytkownika może obejmować wiele systemów, które są używane dynamicznie. W rezultacie może być generowanych wiele powiadomień z różnych systemów, ale związanych z tym samym problemem lub incydentem. DX OI wykorzystuje opatentowane mechanizmy do tłumienia nadmiarowych i powtarzających się powiadomień oraz korelacji powiązanych powiadomień, aby poprawić wykrywanie krytycznych problemów i szybsze ich rozwiązanie.

Rozważmy przykład, w którym do systemu docierają liczne alarmy awaryjne dotyczące różnych obiektów (KE), leżących u podstaw jednego serwisu. W przypadku wpływu na dostępność i funkcjonalność serwisu system wygeneruje alarm serwisowy (Service Alarm), wskaże i oznaczy prawdopodobną przyczynę źródłową (problemowy KE i alarm awaryjny dla KE), która przyczyniła się do obniżenia wydajności lub awarii serwisu. Na poniższym rysunku przedstawiona jest wizualizacja sytuacji awaryjnej dla serwisu Webex.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

DX OI umożliwia zarządzanie zdarzeniami poprzez intuicyjne działania w interfejsie webowym systemu. Użytkownicy mogą ręcznie przypisywać zdarzenia do odpowiedzialnych pracowników w celu rozwiązania problemów, resetować/potwierdzać powiadomienia, tworzyć zgłoszenia lub wysyłać powiadomienia e-mail, uruchamiać zautomatyzowane skrypty w celu usunięcia sytuacji awaryjnej (Remediation Workflow, o czym trochę później). Dzięki temu DX OI pozwala operatorom zmianowym skupić się na głównym komunikacie o awarii oraz pomoże uprościć proces sortowania komunikatów na klastry.

Maszynowe algorytmy przetwarzania metryk i analizy danych wydajnościowych.

Uczenie maszynowe pozwala na śledzenie, agregowanie i wizualizowanie kluczowych wskaźników wydajności w dowolnym danym okresie, co przekłada się na następujące korzyści dla użytkownika:

  • Wykrywanie wąskich gardeł i anomalii wydajności;
  • Porównanie kilku wskaźników dla tych samych urządzeń, interfejsów lub sieci;
  • Porównanie identycznych wskaźników na różnych obiektach;
  • Porównanie różnych wskaźników dla jednego lub kilku obiektów;
  • Porównanie wielowymiarowych metryk dla kilku obiektów.

Aby analizować metryki napływające do systemu, DX OI wykorzystuje funkcje analityki maszynowej z zastosowaniem algorytmów matematycznych, co przyczynia się do skrócenia czasu konfiguracji statycznych progów i generowania powiadomień w przypadku wystąpienia anomalii.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Rezultatem zastosowania algorytmów matematycznych jest zbudowanie tzw. rozkładów prawdopodobieństwa wartości metryki (Rzadkie, Prawdopodobne, Środek, Średnia, Aktuelle). Na powyższych i poniższych rysunkach przedstawione są rozkłady prawdopodobieństwa.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Na dwóch powyższych wykresach przedstawione są następujące dane:

  • Dane rzeczywiste (Aktuelle). Dane rzeczywiste są wyświetlane na wykresie jako ciągła czarna linia (brak alarmów) lub kolorowa ciągła linia (stan alarmowy). Linia jest obliczana na podstawie rzeczywistych danych dla metryki. Porównując dane rzeczywiste z medianą, szybko można zauważyć wariacje metryki. Gdy wystąpi zdarzenie, czarna linia zmienia się na kolorową ciągłą linię, która odpowiada krytyczności zdarzenia i wyświetla symbole z odpowiednią krytycznością nad wykresem. Na przykład, czerwony kolor dla krytycznej anomalii, pomarańczowy dla znacznej anomalii i żółty dla nieznacznej anomalii.
  • Średnia wartość wskaźnika (Średnia wartość). Średnia wartość lub wartość średnia wskaźnika jest pokazana na wykresie szarym linią. Średnia wartość jest wyświetlana, gdy brakuje danych historycznych.
  • Wartość mediany wskaźnika (Wartość środkowa). Linia mediany jest środkiem zakresu i pokazana jest zieloną przerywaną linią. Obszary znajdujące się najbliżej tej linii są najbliższe typowym wartościom wskaźnika.
  • Dane ogólne (Wartość wspólna). Dane ogólnej strefy monitorują najbliższe do linii środkowej lub normy dla twojego wskaźnika i są wyświetlane jako ciemnozielona linia. Obliczenia analityczne umieszczają ogólną strefę o jeden percentyl wyżej lub niżej od normy.
  • Dane prawdopodobieństwa. Dane strefy prawdopodobieństwa są pokazane na wykresie jako zielona linia. System umieszcza strefę prawdopodobieństwa o dwa percentyle wyżej lub niżej od normy.
  • Dane rzadkie. Informacje o rzadkich obszarach przedstawione są na wykresie w postaci jasnoszarego pasma. System umieszcza obszar z rzadkimi wartościami metryki na trzy percentyle powyżej lub poniżej normy i sygnalizuje o zachowaniu wskaźnika poza normalnym zakresem, generując tzw. Anomaly Alert.

Anomalia to pomiar lub zdarzenie, które nie pasuje do normalnych wskaźników metryki. Wykrywanie anomalii w celu identyfikacji problemów i zrozumienia trendów w infrastrukturze i aplikacjach jest kluczową funkcjonalnością DX OI. Wykrywanie anomalii pozwala rozpoznawać nietypowe zachowania (np. serwer działający wolniej niż zwykle lub nietypowa aktywność sieciowa spowodowana włamaniem), a także reagować w odpowiedni sposób (otwierając incydent, uruchamiając automatyczny skrypt Remediation).

Funkcja wykrywania anomalii DX OI zapewnia następujące korzyści:

  • Nie ma potrzeby ustalania wartości progowych. DX OI automatycznie porówna dane i zidentyfikuje anomalie.
  • DX OI zawiera ponad dziesięć algorytmów sztucznej inteligencji i uczenia maszynowego, w tym EWMA (Exponentially-Weighted—Moving-Average) oraz KDE (Kernel Density Estimation). Algorytmy te umożliwiają szybki analizę przyczynową oraz przewidywanie przyszłych wartości metryk.

Analiza predykcyjna i powiadamianie o możliwych awariach

Predictive Insights to funkcja, która wykorzystuje możliwości uczenia maszynowego do identyfikacji wzorców i trendów. Na podstawie tych trendów system przewiduje zdarzenia, które mogą wystąpić w przyszłości. Te powiadomienia wskazują na konieczność podjęcia działań zanim wartości metryk wyjdą poza normy, co może mieć wpływ na krytyczne usługi biznesowe. Predictive Insights są przedstawione na poniższym rysunku.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

A to wizualizacja predykcyjnych powiadomień dla konkretnej metryki.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Prognozowanie obciążenia zasobów obliczeniowych z funkcją ustalania scenariuszy obciążenia

Funkcja planowania zasobów Capacity Analytics pomaga w zarządzaniu zasobami IT, zapewniając odpowiedni rozmiar zasobów dla zaspokojenia bieżących i przyszłych potrzeb biznesu. Będziesz mógł optymalizować wydajność i efektywność dostępnych zasobów oraz zaplanować i uzasadnić wszelkie inwestycje finansowe.

Funkcja Capacity Analytics w DX OI oferuje następujące korzyści:

  • Prognozowanie mocy w szczytowych sezonach;
  • Określenie momentu, kiedy będą potrzebne dodatkowe zasoby, aby zapewnić prawidłowe funkcjonowanie usługi;
  • Zakup dodatkowych zasobów tylko w razie potrzeby;
  • Efektywne zarządzanie infrastrukturą i sieciami;
  • Eliminacja zbędnych kosztów energii poprzez identyfikację niewykorzystanych zasobów;
  • Wykonanie oceny obciążenia zasobów w przypadku planowanego zwiększenia potrzeb w usłudze lub zasobie.

Na stronie Capacity Analytics DX OI (rysunek poniżej) znajdują się następujące widgety:

  • Stan pojemności zasobu (Resource Capacity Status);
  • Monitorowane grupy/usługi (Monitored Groups/Services);
  • Najwięksi konsumenci zasobów (Top Capacity Consumers).

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Główna strona Capacity Analytics pokazuje komponenty zasobów, które są nadmiernie obciążone i mają kończącą się pojemność. Ta strona pomaga administratorom platformy znajdować nadmiernie wykorzystywane zasoby i pomaga im dostosowywać rozmiar oraz optymalizować zasoby. Stan zasobów można analizować na podstawie kodów kolorów i ich odpowiadających wartości. Zasoby klasyfikowane są w zależności od stopnia ich przeciążenia na stronie stanu pojemności zasobów. Można kliknąć każdy z kolorów, aby zobaczyć listę komponentów w wybranej kategorii. Następnie wyświetli się mapa cieplna ze wszystkimi obiektami i prognozami na 12 miesięcy, co pozwala zidentyfikować zasoby, które wkrótce się wyczerpią.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Dla każdej z metryk w Capacity Analytics można określić filtry, które DX Operational Intelligence wykorzystuje do sporządzania prognoz (rysunek poniżej).

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Dostępne są następujące filtry:

  • Metryka. Metryka, która będzie używana do prognozy.
  • Na podstawie. Wybór zakresu danych historycznych, które będą wykorzystane do budowy prognoz na przyszłość. To pole służy do porównania i analizy trendów z ostatniego miesiąca, trendów z ostatnich 3 miesięcy, trendów z roku itp.
  • Wzrost. Oczekiwana prędkość wzrostu obciążenia, którą chcesz wykorzystać do modelowania prognozy mocy. Te dane można wykorzystać do prognozowania wzrostu ponad prognozy. Na przykład oczekuje się, że wykorzystanie zasobów wzrośnie o 40 procent z powodu otwarcia nowego biura.

Analiza logów

Funkcja analizy logów DX OI zapewnia:

  • zbieranie, agregację logów z różnych źródeł (w tym uzyskanych w sposób agentowy i bezagentowy);
  • parsowanie i normalizację danych;
  • analizę na zgodność z ustalonymi warunkami i generowanie zdarzeń;
  • korelację zdarzeń na podstawie logów, w tym z zdarzeniami uzyskanymi w wyniku monitorowania infrastruktury IT;
  • wizualizację danych na podstawie analizy w DX Dashboards;
  • wnioski o dostępności usług na podstawie analizy danych z logów.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Zbieranie logów metodą bezagentową wykonuje system dla logów zdarzeń Windows i Syslog. Logi tekstowe zbierane są w sposób agentowy.

Funkcja automatyzacji rozwiązania sytuacji awaryjnej (Remediation)

Zautomatyzowane działania mające na celu naprawę sytuacji awaryjnej (Remediation Workflow) pozwalają rozwiązać problemy, które spowodowały generowanie zdarzenia w DX OI. Na przykład problem z obciążeniem CPU generuje komunikat awaryjny, a proces naprawczy (Remediation Workflow) rozwiązuje problem poprzez ponowne uruchomienie serwera, na którym wystąpił problem. Integracja między DX OI a systemem automatyzacji pozwala uruchamiać procesy naprawcze z konsoli zdarzeń w DX Operational Intelligence i śledzić je w konsoli systemu automatyzacji.

Po integracji z systemem automatyzacji można uruchamiać automatyczne działania naprawcze w konsoli DX OI z kontekstu komunikatu awaryjnego. Możesz przeglądać zalecane działania wraz z informacjami o procentach pewności (prawdopodobieństwa rozwiązania problemu poprzez wykonanie działania).

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Początkowo, kiedy brak jest statystyk dotyczących wyników wykonania Remediation Workflow, mechanizm rekomendacji proponuje potencjalne opcje na podstawie wyszukiwania, według słów kluczowych, następnie wykorzystuje wyniki uczenia maszynowego, a mechanizm zaczyna rekomendować metodę naprawy na podstawie heurystyki. Gdy zaczniesz oceniać wyniki uzyskanych wskazówek, dokładność rekomendacji poprawi się.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Przykład opinii zwrotnej od użytkownika: użytkownik wybiera pożądane lub niepożądane działanie, a system uwzględnia ten wybór przy kolejnych rekomendacjach. Lajk/nie lajk:

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Zalecane działania korygujące dla konkretnego problemu opierają się na kombinacji opinii zwrotnej, która określa, czy działanie jest akceptowalne. DX OI oferuje gotową integrację z systemem automatyzacji Automic Automation.

Integracja DX OI z systemami zewnętrznymi

Nie będziemy szczegółowo omawiać integracji danych z natywnych produktów monitorowania Broadcom (DX NetOps, DX Infrastructure Management, DX Application Performance Management). Zamiast tego przyjrzymy się, jak integrowane są dane z zewnętrznych systemów 3rd-party i omówimy przykład integracji z jednym z najpopularniejszych systemów — Zabbix.

Do integracji z systemami zewnętrznymi używany jest komponent DX Gateway. DX Gateway składa się z 3 komponentów — On-Prem Gateway, RESTmon i Log Collector (Logstash). Możesz zainstalować wszystkie 3 komponenty lub tylko ten, który jest potrzebny, zmieniając ogólny plik konfiguracyjny podczas instalacji DX Gateway. Na poniższym rysunku przedstawiono architekturę DX Gateway.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Przyjrzyjmy się osobno przeznaczeniu komponentów DX Gateway.

On-Prem Gateway. To interfejs, który zbiera sygnały awaryjne z platformy DX i przesyła zdarzenia o awariach do systemów zewnętrznych. On-Prem Gateway działa jako polling, który okresowo zbiera dane o zdarzeniach z DX OI, używając zapytań API poprzez protokół HTTPS, a następnie wysyła powiadomienia na zewnętrzny serwer, który jest zintegrowany z platformą DX, używając webhooków.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

DX Log Collector przyjmuje syslog od urządzeń sieciowych lub serwerów i przesyła je do OI. DX Log Collector pozwala na rozdzielenie oprogramowania, które generuje wiadomości, systemu, który je przechowuje, oraz oprogramowania, które je informuje i analizuje. Każda wiadomość jest oznaczona kodem obiektu, który wskazuje typ oprogramowania generującego wiadomość, i przypisywana jej jest poziom krytyczności. W DX Dashboards można to wszystko zobaczyć później.

DX RESTmon integruje się z zewnętrznymi produktami/usługami poprzez REST API i przekazuje dane do OI. Na poniższym rysunku przedstawiono schemat działania DX RESTmon na przykładzie integracji z systemami monitorowania Solarwinds i SCOM.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Kluczowe funkcje DX RESTmon:

  • Połączenie z dowolnym zewnętrznym źródłem danych w celu odbierania danych:
    • PULL: łączenie i wydobywanie danych z publicznych API REST;
    • PUSH: przesyłanie danych do RESTmon za pośrednictwem REST.
  • Wsparcie dla formatów JSON i XML;
  • Odbieranie metryk, alarmów, grup, topologii, inwentarza i logów;
  • Gotowe konektory dla różnych narzędzi/technologii, możliwe jest również opracowanie konektora do dowolnego źródła z otwartym API (lista gotowych konektorów na poniższym rysunku);
  • Wsparcie dla podstawowej autoryzacji (domyślnie) przy dostępie do interfejsu Swagger i API;
  • Wsparcie HTTPS (domyślnie) dla wszystkich przychodzących i wychodzących wiadomości;
  • Wsparcie dla przychodzących i wychodzących proxy;
  • Potężne możliwości analizy składniowej tekstu dla logów otrzymanych przez REST;
  • Dostosowywana analiza składniowa za pomocą RESTmon, zapewniająca efektywną analizę i wizualizację logów;
  • Wsparcie dla wydobywania informacji o grupach urządzeń z aplikacji monitorujących i ich ładowania do OI w celu analizy i wizualizacji;
  • Wsparcie dla możliwości dopasowywania z wyrażeniami regularnymi. Może to być używane do analizy składniowej i dopasowywania wiadomości logów, otrzymanych przez REST, oraz do generowania lub zamykania wydarzeń w oparciu o określone warunki wyrażenia regularnego.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Teraz rozważmy proces konfiguracji integracji DX OI z Zabbix przez DX RESTmon. Wbudowana integracja pobiera z Zabbix następujące dane:

  • dane inwentarza;
  • topologia;
  • problemy;
  • metryki.

Ponieważ konektor do Zabbix jest dostępny od ręki, wszystko, co należy zrobić w celu skonfigurowania integracji, to zaktualizować profil, podając adres IP serwera API Zabbix i konto, a następnie załadować profil za pośrednictwem interfejsu webowego Swagger. Przykład na dwóch poniższych rysunkach.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Po skonfigurowaniu integracji, analityczne funkcje DX OI, opisane powyżej, będą dostępne dla danych przychodzących z Zabbix, mianowicie: Alarm Analytics, Performance Analytics, Predictive Insights, Service Analytics oraz Remediation. Na poniższym rysunku znajduje się przykład analizy metryk wydajności dla obiektów, które zostały zintegrowane z Zabbix.

Zintegrowany system monitorowania i modele usługowe w zaktualizowanej DX Operations Intelligence od Broadcom (dawniej CA)

Podsumowanie

DX OI — nowoczesne narzędzie analityczne, które zapewni znaczną efektywność operacyjną działów IT, umożliwi szybsze i trafniejsze podejmowanie decyzji w celu poprawy jakości usług IT i usług biznesowych poprzez międzydomenową analizę kontekstową. Dla właścicieli aplikacji i działów biznesowych DX OI obliczy wskaźnik dostępności oraz jakość usług nie tylko w kontekście technologicznych wskaźników IT, ale także KPI biznesowych, uzyskiwanych z statystyki transakcyjnej dotyczącej użytkowników końcowych.

Jeśli chcesz dowiedzieć się więcej o tym rozwiązaniu, zostaw zgłoszenie na demonstrację lub projekt pilotażowy. w dogodny dla Ciebie sposób. na naszej stronie.

Źródło: habr.com

Kup solidny hosting stron z ochroną przed DDoS, serwery VPS VDS 🔥 Kup solidny hosting stron z ochroną przed DDoS, serwery VPS VDS | ProHoster