Le check Node CPU by API permet de vérifier l’utilisation CPU du nœud Proxmox supervisé.
Sur un nœud Proxmox, l'utilisation CPU correspond à l'utilisation du système additionnée à la consommation de l'ensemble des machines virtuelles lancées sur celui-ci.
Le changement de statut repose sur une seule règle :
Si l’utilisation CPU dépasse les seuils définis ( warning ou critical ), alors le statut du check change automatiquement.
Ce check permet donc :
de repérer rapidement une surcharge CPU,
de détecter une activité anormale,
de prévenir une saturation système.
Pour résumer, ce check est un indicateur clé pour vérifier le fonctionnement normal d'un nœud Proxmox.
Le check utilise la ligne de commande suivante :
$SHINKEN_PROXMOX-VE-BY-API_PLUGINSDIR$/check_proxmox_ve.py
--host $HOSTADDRESS$
--node-name $_HOSTPROXMOX-VE-BY-API__NODE-NAME$
--user $_HOSTPROXMOX-VE-BY-API__USER$
--token $_HOSTPROXMOX-VE-BY-API__TOKEN$
--mode "node_cpu"
--warn $_HOSTPROXMOX-VE-BY-API__NODE-CPU__NODE-CPU-WARN$
--crit $_HOSTPROXMOX-VE-BY-API__NODE-CPU__NODE-CPU-CRIT$
--ssl-verify $_HOSTPROXMOX-VE-BY-API__SSL__USE-SSL$ |
| Nom | Modifiable sur | Unité | Défaut | Valeur par défaut à l'installation de Shinken | Description | |
|---|---|---|---|---|---|---|
| l'Hôte ( Onglet Données ) | -- | __ | __ | La liste des conteneurs à exclure des vérifications. Cette donnée n'est utilisée que pour les checks des modèles "all_containers" | |
| l'Hôte ( Onglet Données ) | -- | __ | __ | La liste des images à exclure des vérifications pour le check "Image-age". Cette donnée n'est utilisée que pour les checks des modèles "all_containers" | |
| l'Hôte ( Onglet Données ) | % | 90 | 90 | Définit le pourcentage d'utilisation CPU à partir duquel le check passe en CRITIQUE.
| |
| l'Hôte ( Onglet Données ) | % | 80 | 80 | Définit le pourcentage d'utilisation CPU à partir duquel le check passe en ATTENTION .
|
Pas de données DFE pour ce check
Pas de données provenant du check pour ce modèle
|
Il peut prendre 3 états OK / CRITIQUE / ATTENTION .
Le statut va dépendre du retour de sonde et de la configuration spécifique du check pour les données suivantes :
Ci-dessous, un tableau récapitulatif des différents retours possibles :
Le texte de la colonne "Affichage des seuils" montre les paramètres utilisés et leur valeur définie sur l'équipement supervisé. |
| Situation | Statut | Exemple |
|---|---|---|
| ATTENTION | |
| CRITIQUE |
Le résultat court affiche, en une ligne, un résumé de l'état des conteneurs. Ce retour compact permet de pouvoir visualiser l'information même avec la taille des lignes réduites dans l'interface de visualisation.
Le résultat long affiche un tableau regroupant l'ensemble des conteneurs détectés et leurs consommations CPU.
| Nom de la métrique | Unité | Description | Seuil d'avertissement | Seuil critique |
|---|---|---|---|---|
| (nom-du-container)__cpu | % | Retourne le pourcentage de temps CPU actif au cours de la dernière seconde ( Correspond au % affiché dans le résultat du check ). | DOCKER-ON-LINUX-BY-SSH__CPU__CPU-WARN | DOCKER-ON-LINUX-BY-SSH__CPU__CPU-CRIT |