Personnaliser la collection de métriques OpenTelemetry pour les machines virtuelles dans Azure Monitor

Lorsque vous activez l’expérience basée sur les métriques pour surveiller vos machines virtuelles Azure, un ensemble par défaut de métriques est collecté. Selon vos sélections d’intégration, les métriques OpenTelemetry par processus peuvent déjà être activées. Vous pouvez personnaliser votre collection en modifiant la règle de collecte de données (DCR) pour ajouter ou supprimer des métriques telles que les performances par processus, l’utilisation du disque logique, l’utilisation du système de fichiers et d’autres métriques spécifiques à la charge de travail.

Les détails de la création de la DCR sont fournis dans Collecter des données à partir du client de machine virtuelle avec Azure Monitor. Cet article fournit des détails supplémentaires pour le type de source de données OpenTelemetry Performance Counters.

Note

Pour utiliser directement la définition DCR ou pour effectuer un déploiement avec d’autres méthodes telles que des modèles ARM, consultez les exemples de règle de collecte de données (DCR) dans Azure Monitor.

Coûts

L’ensemble par défaut de métriques OpenTelemetry est collecté sans coût. Il existe un coût supplémentaire pour collecter les mesures OTel supplémentaires au-delà de l'ensemble par défaut. Pour plus d’informations sur la tarification, consultez la tarification d’Azure Monitor .

Prerequisites

Identifier la règle de collecte de données (DCR)

Pour identifier la DCR associée à la machine virtuelle, ouvrez Data Collection Rules à partir du menu Monitor dans le Azure portal. Sélectionnez l’onglet Ressources et recherchez votre machine virtuelle.

Capture d’écran de l’onglet Ressources de l’élément de menu Règles de collecte de données.

Cliquez sur le numéro dans la colonne règles de collecte de données pour répertorier les contrôleurs de domaine associés à la machine virtuelle. Le DCR OTel aura un nom au format MSVMOtel-<region>-<name>. Cliquez sur le DCR pour l’ouvrir.

Capture d’écran des DCRs associés à la ressource sélectionnée.

Configurer la source de données

Sous l’onglet Sources de données de la DCR, cliquez sur la source de données OpenTelemetry Performance Counters . Sélectionnez un ensemble prédéfini d’objets pour collecter et leur taux d’échantillonnage. Plus le taux d’échantillonnage est réduit, plus la valeur est collectée plus fréquemment.

Capture d’écran montrant le formulaire du portail Azure pour sélectionner les compteurs de performances OpenTelemetry de base dans une règle de collecte de données.

Sélectionnez Personnalisé pour une sélection plus granulaire des compteurs de performances OpenTelemetry.

Capture d’écran montrant le formulaire du portail Azure pour sélectionner des compteurs de performances OpenTelemetry personnalisés dans une règle de collecte de données.

Vérifier la collecte de données

Pour vérifier que les compteurs de performances OpenTelemetry sont collectés, définissez une requête dans l’espace de travail Azure Monitor et vérifiez que les données sont retournées pour les métriques sélectionnées.

Capture d’écran montrant les enregistrements retournés à partir d’un AMW.

Si l’espace de travail a été défini sur le mode d’accès au contexte des ressources, vous pouvez également vérifier que la même requête fonctionne comme prévu lorsqu’elle est étendue à la machine virtuelle elle-même en accédant au panneau Métriques de la machine virtuelle. Choisissez l’option ajouter avec l’éditeur dans la liste déroulante ou Visualisez les métriques AMW dans l’éditeur dans la liste déroulante sous Espaces de noms de métriques.

Capture d’écran montrant comment accéder à l’éditeur AMW PromQL à partir d’un panneau Métriques de machine virtuelle.

Les deux points d’entrée doivent entraîner un éditeur PromQL avec une requête délimitée à la ressource de machine virtuelle maintenant, où la même requête fonctionnera comme précédemment, mais sans avoir à filtrer sur la dimension microsoft.resourceid de la machine virtuelle.

Capture d’écran montrant les enregistrements retournés à partir d’une machine virtuelle, stockés dans un AMW.

Capture d’écran montrant l’étendue de la requête sur la machine virtuelle plutôt que sur AMW.

Informations de référence sur les métriques

Les tableaux suivants répertorient les métriques OpenTelemetry disponibles pour les machines virtuelles.

Métriques par défaut

Les métriques du tableau suivant sont collectées par défaut et sans coût supplémentaire.

Nom de métrique Description
temps de fonctionnement du système Heure depuis le dernier redémarrage (en secondes)
système.tempsdeprocesseur Temps processeur total consommé (utilisateur + système + inactif), en secondes
system.memory.usage Mémoire en cours d’utilisation (octets)
system.network.io Octets transmis/reçus
system.network.dropped Paquets perdus
erreurs.du.réseau.système Erreurs réseau
system.disk.io Entrée/Sortie disque (octets en lecture/écriture)
système.disque.opérations Opérations de disque (nombres en lecture/écriture)
system.filesystem.usage Utilisation du système de fichiers en octets
système.disque.temps_de_fonctionnement Durée moyenne de l’opération de disque

Métriques supplémentaires

Les métriques du tableau suivant peuvent être collectées en modifiant la DCR pour la machine virtuelle, comme décrit ci-dessus. Il existe un coût supplémentaire pour collecter ces métriques au-delà du jeu de métriques par défaut.

Nom de métrique Description
system.cpu.utilization Utilisation du processeur %
system.cpu.logical.count Nombre de processeurs logiques
system.cpu.physical.count Nombre de processeurs physiques
system.cpu.frequency Fréquence du processeur
system.cpu.load_average.1m Moyenne de charge système (1 min)
system.cpu.load_average.5m Moyenne de charge système (5 minutes)
Moyenne de la charge du système (system.cpu.load_average.15m) sur 15 minutes Moyenne de charge système (15 minutes)
system.memory.utilization Mémoire utilisée %
system.memory.limit Limite totale de mémoire
système.mémoire.taille_page Taille de page (octets)
system.linux.memory.available Mémoire disponible
system.linux.memory.dirty Pages de mémoire avec une intégrité compromise
system.paging.faults Erreurs de page
system.paging.operations Opérations de pagination (lectures/écritures)
system.paging.usage Utilisation de la pagination/échange (octets)
system.paging.utilization % pagination/échange utilisé
system.disk.io_time Temps passé à effectuer des E/S
system.disk.merged Nombre d’opérations fusionnées
system.disk.opérations_en_attente Opérations d’E/S en attente
system.disk.weighted_io_time Temps d’E/S pondéré (tient compte de la profondeur de file d’attente)
system.filesystem.utilization % d’utilisation du système de fichiers
system.filesystem.inodes.usage Utilisation des inodes
système.réseau.packets Paquets transmis/reçus
système.réseau.connexions Connexions réseau actives
system.network.conntrack.count Entrées de table conntrack actuelles
system.network.conntrack.max Taille maximale de la table conntrack
temps de fonctionnement du processus Durée de fonctionnement du processus
process.cpu.time Temps processeur consommé par processus
process.cpu.utilization Utilisation du processeur % par processus
process.memory.usage Utilisation de la mémoire (RSS)
processus.mémoire.virtuelle Utilisation de la mémoire virtuelle
process.memory.utilization Utilisation de la mémoire %
process.disk.io E/S disque (octets par processus)
process.disk.operations Opérations de disque par processus
processus.défauts_de_pagination Erreurs de page de traitement
processus.descripteurs_de_fichiers_ouverts Ouvrir des descripteurs de fichier
process.threads Nombre de threads
process.handles Handles en cours d’utilisation (Windows)
process.context_switches Commutateurs de contexte
process.signals_pending Signaux en attente
system.processes.count Nombre total de processus
system.processes.created Processus créés

Pour obtenir une référence complète avec des types, des unités, des dimensions et d’autres métadonnées, consultez la référence des métriques OpenTelemetry.

Étapes suivantes