Interview avec Zabbix : 12 réponses franches

Dans le secteur IT, il existe une superstition : « Ça fonctionne, ne touche pas ». On peut dire la même chose de notre système de surveillance. Chez Southbridge, nous utilisons Zabbix — lorsque nous l'avons choisi, il était très performant. Et, en réalité, il n'avait pas d'alternatives.

Au fil du temps, notre écosystème a été enrichi de manuels, de modules supplémentaires, et une intégration avec redmine est apparue. Zabbix a rencontré un concurrent puissant, qui le surpassait dans de nombreux domaines : vitesse de fonctionnement, haute disponibilité pratiquement prête à l'emploi, belle visualisation et optimisation des performances dans les environnements kubernetes.

Mais nous ne sommes pas pressés de passer à autre chose. Nous avons décidé de jeter un œil chez Zabbix et de nous renseigner sur les fonctionnalités qu'ils prévoient dans les prochaines versions. Nous n'avons pas été tendres et avons posé des questions délicates à Sergey Sorokin, directeur du développement de Zabbix, et à Vitaly Zhuravlev, architecte de solutions. Voici ce que cela a donné.

Interview avec Zabbix : 12 réponses franches

1. Parlez-nous de l'histoire de l'entreprise. Comment l'idée du produit a-t-elle vu le jour ?

L'histoire de l'entreprise a commencé en 1997, lorsque le fondateur et propriétaire, Alexey Vladychev, travaillait comme administrateur de bases de données dans une banque. Alexey trouvait inefficace de gérer des bases sans disposer de données sur les valeurs historiques de divers paramètres, sans comprendre l'état actuel et historique de l'environnement.

Les solutions de surveillance disponibles sur le marché à l'époque étaient très coûteuses, peu flexibles et nécessitaient beaucoup de ressources. C'est pourquoi Alexey commence à écrire divers scripts qui lui permettent de surveiller efficacement la partie de l'infrastructure qui lui est confiée. Cela devient un hobby. Alexey change d'emploi, mais son intérêt pour le projet reste. Entre 2000 et 2001, le projet est réécrit depuis le début - et Alexey envisage de permettre à d'autres administrateurs d'utiliser ses développements. La question se pose alors de sous quelle licence publier le code existant. Alexey décide de le libérer sous la licence GPLv2. L'outil est rapidement remarqué dans le milieu professionnel. Avec le temps, Alexey reçoit des demandes de support, de formation et d'élargissement des fonctionnalités du logiciel. Le nombre de ces commandes augmente constamment. C'est ainsi, naturellement, qu'est venue la décision de créer une entreprise. L'entreprise a été fondée le 12 avril 2005.

Interview avec Zabbix : 12 réponses franches

2. Quels points clés pouvez-vous identifier dans l'histoire de Zabbix ?

Il y a plusieurs points clés à ce jour :
a. Début du travail d'Alexey sur les scripts - 1997.
b. Publication du code sous la licence GPLv2 - 2001.
c. Création de l'entreprise Zabbix - 2005.
d. Signature des premiers contrats de partenariat, création d'un programme de partenariat - 2007.
e. Création de Zabbix Japan LLC - 2012.
f. Création de Zabbix LLC (USA) - 2015.
g. Création de LLC Zabbix - 2018.

3. Combien de personnes travaillent pour vous ?

À l'heure actuelle, le groupe d'entreprises Zabbix compte un peu plus de 70 employés : développeurs, testeurs, chefs de projet, ingénieurs de support, consultants, commerciaux, employés marketing.

4. Comment rédigez-vous la feuille de route, recueillez-vous des retours d'expérience des utilisateurs ? Comment déterminez-vous la direction à suivre ?

Lors de la création de la feuille de route pour la prochaine version de Zabbix, nous nous concentrons sur les facteurs importants suivants, c'est-à-dire que nous recueillons des informations pour la feuille de route dans les catégories suivantes :

a. Améliorations stratégiques de Zabbix. Que Zabbix considère comme très important. Par exemple, l'agent Zabbix écrit en Go.
b. Des choses que les clients et partenaires de Zabbix souhaitent voir dans Zabbix. Et pour lesquelles ils sont prêts à payer.
c. Souhaits/propositions de la communauté Zabbix.
Les dettes techniques. 🙂 Des éléments que nous avons publiés dans les versions précédentes, mais que nous n'avons pas entièrement fonctionnels, que nous n'avons pas rendus suffisamment flexibles, et qui n'offrent pas toutes les options.

Interview avec Zabbix : 12 réponses franches

5. Pouvez-vous comparer Zabbix et Prometheus ? Qu'est-ce qui est mieux dans Zabbix et qu'est-ce qui est moins bien ?

À notre avis, la principale différence est que Prometheus est avant tout un système de collecte de métriques — et pour établir une surveillance complète en entreprise, il est nécessaire d'ajouter de nombreux autres composants à Prometheus, comme Grafana pour la visualisation, un stockage long terme distinct, un gestionnaire de problèmes séparé, un traitement séparé des journaux...

Il n'y aura pas de modèles de surveillance standards dans Prometheus, une fois toutes les milliers de métriques obtenues des exportateurs, il faudra soi-même identifier les signaux problématiques. La configuration de Prometheus se fait via des fichiers de configuration. Parfois cela est plus pratique, d'autres fois moins.

Zabbix est une plateforme universelle pour créer une surveillance « de A à Z », avec notre propre visualisation, la corrélation des problèmes et leur affichage, la distribution des droits d'accès au système, l'audit des actions, de nombreuses options de collecte de données via des agents, des proxies, selon des protocoles totalement différents, avec la possibilité d'étendre rapidement le système grâce à des plugins, des scripts, des modules...

On peut également simplement collecter des données telles quelles, par exemple via le protocole HTTP, puis transformer les réponses en métriques utiles grâce à des fonctions de prétraitement comme JavaScript, JSONPath, XMLPath, CSV et techniques similaires. De nombreux utilisateurs apprécient Zabbix pour la possibilité de configurer et de gérer le système via une interface web, pour la possibilité de décrire des configurations standards de surveillance sous forme de modèles, que l'on peut partager, et contenant non seulement des métriques mais aussi des règles de détection, des seuils, des graphiques, des descriptions — un ensemble complet d'objets pour surveiller des objets types.

Beaucoup apprécient également la possibilité d'automatiser la gestion et la configuration via l'API Zabbix. En gros, nous ne voulons pas créer de guerre éternelle. Nous pensons que les deux systèmes sont bien adaptés à leurs tâches et peuvent se compléter harmonieusement, par exemple, depuis la version 4.2, Zabbix peut récupérer des données des exportateurs Prometheus ou de lui-même.

6. Avez-vous pensé à faire Zabbix en mode SaaS ?

Nous avons réfléchi à cela et nous voulons rendre cette solution aussi conviviale que possible pour nos clients. Dans ce cas, le Zabbix standard devrait être proposé avec des moyens de communication, des outils avancés de collecte de données, etc.

7. Quand attendre Zabbix HA ? Et devez-vous attendre ?

On peut clairement s'attendre à Zabbix HA. Nous espérons vraiment voir quelque chose dans Zabbix 5.0 LTS, mais la situation sera plus claire en novembre 2019, lorsque la feuille de route de Zabbix 5.0 sera entièrement confirmée.

8. Pourquoi le type de média a-t-il un choix si limité par défaut ? Envisagez-vous d'ajouter Slack, Telegram, etc. ? Et est-ce que quelqu'un utilise encore Jabber ?

Jabber a été retiré dans Zabbix 4.4, mais des Webhooks ont été ajoutés. Quant aux types de médias, nous ne souhaitons pas créer des applications spécifiques à partir du système, mais plutôt des moyens de communication standard. Il n'est pas un secret que de nombreux chats ou centres de service similaires ont une API via HTTP — donc cette année, avec la sortie de 4.4, la situation changera.

Avec l'apparition des webhooks dans Zabbix, on peut s'attendre à toutes les intégrations les plus demandées par défaut dans un avenir proche. De plus, les intégrations seront bidirectionnelles, et non seulement de simples notifications dans un sens. Et les types de médias que nous ne toucherons pas seront réalisés par notre communauté — car maintenant, le type de média peut être entièrement exporté dans un fichier de configuration, partagé sur share.zabbix.com ou GitHub. Les autres utilisateurs n'auront qu'à importer le fichier pour commencer à utiliser cette intégration. Aucun script supplémentaire ne sera nécessaire !

9. Pourquoi le développement de la découverte de machines virtuelles n'avance-t-il pas ? Il n'y a que VMware. Beaucoup attendent l'intégration avec EC2, OpenStack.

Non, cette direction se développe. Par exemple, dans 4.4, la découverte de datastore a été ajoutée via la clé vm.datastore.discovery. Dans 4.4, des clés WMI très intéressantes ont également été ajoutées – nous nous attendons à ce qu'avec celle-ci, ainsi qu'avec la clé perf_counter_en, un bon suivi de Hyper-V soit possible. Et d'autres changements importants dans ce domaine sont prévus dans Zabbix 5.0.

Interview avec Zabbix : 12 réponses franches

10. N'avez-vous pas pensé à abandonner les modèles et à faire comme chez Prometheus, où tout ce qui est donné est récupéré ?

Prometheus collecte automatiquement toutes les métriques, ce qui est pratique. Mais le modèle est plus qu'un simple ensemble de métriques, c'est un « conteneur » qui contient toute la configuration type nécessaire pour surveiller ce type de ressource ou de service. Il comprend déjà un ensemble d'importants déclencheurs, de graphiques, de règles de détection, ainsi que des descriptions des métriques et des seuils, qui aident l'utilisateur à comprendre ce qui est collecté et quels seuils précisément sont vérifiés et pourquoi. De plus, il est facile de partager ces modèles avec d'autres utilisateurs – et ils obtiendront une bonne surveillance de leur système, même sans être nécessairement des experts.

11. Pourquoi si peu de métriques par défaut ? Cela complique énormément la configuration d'un point de vue opérationnel.

Si par défaut vous entendez des modèles prêts à l'emploi, sachez qu'en ce moment, nous travaillons à l'expansion et à l'amélioration de nos modèles. Zabbix 4.4 est sorti avec un ensemble amélioré et de meilleures fonctionnalités.

Pour Zabbix, vous pouvez toujours trouver un modèle prêt à l'emploi pratiquement pour n'importe quel système sur share.zabbix.com. Mais nous avons décidé que nous devions créer des modèles de base nous-mêmes, montrant l'exemple aux autres, tout en libérant les utilisateurs de la nécessité de rédiger encore une fois un modèle pour un MySQL quelconque. Par conséquent, le nombre de modèles officiels dans Zabbix augmentera à chaque version.

Interview avec Zabbix : 12 réponses franches

12. Quand pourra-t-on créer des déclencheurs indépendants des hôtes, par exemple basés sur des labels ? Par exemple, nous surveillons un site à partir de n différents points, et nous voulons un déclencheur simple qui s'active lorsque le site n'est pas accessible depuis 2 points ou plus.

En fait, une telle fonctionnalité existe dans Zabbix depuis plusieurs années, développée pour l'un de nos clients. Le client est ICANN. De plus, de telles vérifications peuvent être effectuées, par exemple, via des items agrégés ou en utilisant l'API Zabbix. Nous travaillons activement à simplifier la création de telles vérifications.

P.S.: Lors d'un des Slyrms, les développeurs de Zabbix nous ont demandé ce que nous aimerions voir dans le produit pour surveiller des clusters Kubernetes précisément avec Zabbix, et non Prometheus.

C'est formidable lorsque les développeurs répondent aux besoins des clients au lieu de rester là sans rien faire. Et maintenant, nous accueillons chaque sortie avec un intérêt sincère – c'est rassurant de voir que de plus en plus de fonctionnalités dont nous avons parlé prennent forme.

Tant que les développeurs ne se renferment pas sur eux-mêmes et s'intéressent aux besoins des clients, le produit vit et évolue. Nous suivrons les nouvelles versions de Zabbix.

P.P.S.: Dans quelques mois, nous lancerons un cours en ligne sur la surveillance. Si cela vous intéresse, abonnez-vous pour ne pas manquer l'annonce. En attendant, vous pouvez suivre notre Slurm sur Kubernetes.

Source : habr.com

Acheter un hébergement fiable pour les sites avec protection DDoS, serveurs VPS VDS 🔥 Acheter un hébergement fiable pour les sites avec protection DDoS, serveurs VPS VDS | ProHoster