Supervision¶
Cette section décrit la supervision à mettre en place sur une plateforme Reemo
déployée avec le rôle reemo-infra : ce qu’il faut contrôler, les sondes à
installer, et les commandes à lancer quand une alerte se déclenche.
Les contrôles dépendent du type d’installation et des options activées (Workstation, appliances, credential portal, TURN, Vault, sauvegardes, etc.).
Choisir votre type d’installation¶
Un seul cluster infra_manager héberge la base de données, l’API et le portail.
Des clusters distincts api_manager, portal_manager et, selon le cas, turn_manager.
Dans les deux cas, des clusters relayws_manager (Relay WebSocket) et
provisionN_manager (Reemo Containers) peuvent compléter l’installation.
Profils de machines¶
Chaque profil correspond à un groupe de l’inventaire Ansible et à un cluster Docker Swarm indépendant.
Profil |
Services hébergés |
|---|---|
|
Tout-en-un : base de données, API, portail, signal, traefik, et selon les options : Workstation, appliances, credential portal, TURN, Vault, sauvegardes. |
|
Base de données, API, proapi, prorelayapi, credentialapi, applianceapi, logapi, Vault, sauvegardes, traefik (mTLS obligatoire). |
|
Portail, portail d’administration, signal, Workstation, appliance portal, credential portal, traefik, et un proxy haproxy vers l’API. |
|
Serveur TURN dédié et traefik. |
|
Relay WebSocket, traefik, nginx. |
|
Machines de provisionnement des conteneurs, nginx. |
Conventions¶
Les exemples utilisent
INSTANCE_NAME=reemo: les services Docker Swarm s’appellent doncreemo_api,reemo_portal, etc. Remplacez ce préfixe par le nom de votre instance.Les ports sont ceux des variables par défaut du rôle. Adaptez-les si vous les avez modifiés dans votre inventaire.
Les sondes sont écrites pour Nagios et se transposent à tout outil qui utilise les mêmes codes retour (Icinga, Centreon, Naemon, Zabbix via un agent, etc.).
Voir aussi¶
Superviser une installation tout-en-un : les contrôles d’une installation
infra_manager.Superviser une installation séparée : les contrôles par profil d’une installation séparée.
Points de contrôle : le détail de chaque point de contrôle, composant par composant.
Sondes Nagios : les scripts de sondes et la configuration Nagios / NRPE.
Faire un état des lieux rapide : un état des lieux en quelques minutes quand un problème survient.
Diagnostic en cas d’alerte : les commandes de diagnostic pour chaque alerte.