Azure Batch 監視データリファレンス

この記事には、このサービスに関するすべての監視リファレンス情報が含まれています。

Azure Batch 用に収集できるデータとその使用方法の詳細については、 Monitor Azure Batch を参照してください。

メトリック

このセクションには、このサービスに関して自動的に収集されるすべてのプラットフォーム メトリックが一覧表示されています。 これらのメトリックは、Azure Monitor でサポートされているすべてのプラットフォーム メトリックのグローバル リストにも含まれています。

メトリックのリテンション期間の詳細については、「Azure Monitor メトリックの概要」を参照してください。

Microsoft.Batch/batchaccounts でサポートされているメトリック

次の表に、Microsoft.Batch/batchaccounts リソースの種類で使用できるメトリックを示します。

Note

この表はバッチアカウントプラットフォームの指標を示しています。 プールの計算ノードからゲストOSのパフォーマンス指標を収集するには、Azure Monitor AgentでのMonitor Azure Batchプール計算ノードを参照してください。

  • すべての列がすべてのテーブルに存在するわけではない場合があります。
  • 一部の列がページの表示領域を超えている場合があります。 [テーブルの展開] を選択すると、使用可能なすべての列が表示されます。

テーブルの見出し

  • カテゴリ - メトリック グループまたは分類。
  • メトリック - Azure Portal に表示されるメトリックの表示名。
  • REST API の名前 - REST API で参照されるメトリック名。
  • 単位 - 測定単位。
  • 集計 - 既定の集計の種類。 有効な値: 平均 (Avg)、最小 (Min)、最大 (Max)、合計 (Sum)、数。
  • ディメンション - メトリックで使用できるディメンション。
  • 時間グレイン - メトリックをサンプリングする間隔。 たとえば、PT1M は、メトリックを 1 分ごとに、PT30Mは 30 分ごとに、PT1H は 1 時間ごとにサンプリングすることを示します。
  • DS エクスポート - メトリックが診断設定を介して Azure Monitor ログにエクスポート可能かどうかを示します。 メトリックのエクスポートについては、「Azure Monitor で診断設定を作成する」を参照してください。

カテゴリ: API

メトリック REST API での名前 高度なプラットフォーム メトリック 出荷単位 集計 Dimensions 期間粒度 DS エクスポート
API 要求数

サービスに対して行われた API 要求の数
ApiCount いいえ カウント 合計 (和) operation、result PT1M はい
API 要求の期間

サーバーが API 要求の処理に費やす時間 (ミリ秒単位) -要求の受信から応答の送信までの時間
ApiDuration いいえ ミリ秒 平均 operation、result PT1M はい

カテゴリ: リソースの割り当て

メトリック REST API での名前 高度なプラットフォーム メトリック 出荷単位 集計 Dimensions 期間粒度 DS エクスポート
専用コア数

Batch アカウントの専用コアの合計数
CoreCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ
ノード数の作成

作成されるノードの数
CreatingNodeCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ
アイドル ノード数

アイドル状態のノードの数
IdleNodeCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ
プール ノード数の残り

プールから移動中のノードの数
LeavingPoolNodeCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ
LowPriority コアの数

Batch アカウントの優先順位の低いコアの合計数
LowPriorityCoreCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ
オフライン ノード数

オフライン ノードの数
OfflineNodeCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ
プール作成イベント

作成されたプールの合計数
PoolCreateEvent いいえ カウント 合計 (和) poolId PT1M はい
プールの削除の完了イベント

完了したプール削除の合計数
PoolDeleteCompleteEvent いいえ カウント 合計 (和) poolId PT1M はい
プールの削除の開始イベント

開始したプール削除の合計数
PoolDeleteStartEvent いいえ カウント 合計 (和) poolId PT1M はい
プールのサイズ変更の完了イベント

完了したプールのサイズ変更の合計数
PoolResizeCompleteEvent いいえ カウント 合計 (和) poolId PT1M はい
プールのサイズ変更の開始イベント

開始したプールのサイズ変更の合計数
PoolResizeStartEvent いいえ カウント 合計 (和) poolId PT1M はい
割り込まれたノード数

割り込まれたノードの数
PreemptedNodeCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ
ノード数の再起動

再起動中のノードの数
RebootingNodeCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ
再イメージ化ノード数

再イメージ化中のノードの数
ReimagingNodeCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ
実行中のノード数

実行中のノードの数
RunningNodeCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ
開始ノード数

開始するノードの数
StartingNodeCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ
タスクの開始に失敗したノード数

開始タスクが失敗したノードの数
StartTaskFailedNodeCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ
優先順位の低いノード数

Batch アカウントの優先順位の低いノードの合計数
TotalLowPriorityNodeCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ
専用ノード数

Batch アカウントの専用ノードの合計数
TotalNodeCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ
不明な状態ノード数

不明な状態ノードの数
UnknownStateNodeCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ
使用できないノード数

使用できないノードの数
UnusableNodeCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ
タスク ノード数の開始を待機しています

開始タスクの完了を待機しているノードの数
WaitingForStartTaskNodeCount いいえ カウント Total (Sum)、Average、Minimum、Maximum <なし> PT1M いいえ

カテゴリ: スケジュール

メトリック REST API での名前 高度なプラットフォーム メトリック 出荷単位 集計 Dimensions 期間粒度 DS エクスポート
ジョブの削除完了イベント

正常に削除されたジョブの合計数。
JobDeleteCompleteEvent いいえ カウント 合計 (和) jobId PT1M はい
ジョブの削除の開始イベント

削除を要求されたジョブの合計数。
JobDeleteStartEvent いいえ カウント 合計 (和) jobId PT1M はい
ジョブの完了イベントの無効化

正常に無効化されたジョブの合計数。
JobDisableCompleteEvent いいえ カウント 合計 (和) jobId PT1M はい
ジョブの開始イベントの無効化

無効化を要求されたジョブの合計数。
JobDisableStartEvent いいえ カウント 合計 (和) jobId PT1M はい
ジョブの開始イベント

正常に開始されたジョブの合計数。
JobStartEvent いいえ カウント 合計 (和) jobId PT1M はい
ジョブ終了完了イベント

正常に終了されたジョブの合計数。
JobTerminateCompleteEvent いいえ カウント 合計 (和) jobId PT1M はい
ジョブ終了の開始イベント

終了を要求されたジョブの合計数。
JobTerminateStartEvent いいえ カウント 合計 (和) jobId PT1M はい
タスク完了イベント

完了したタスクの合計数
TaskCompleteEvent いいえ カウント 合計 (和) poolId、jobId PT1M はい
タスクの失敗イベント

障害状態で完了したタスクの合計数
TaskFailEvent いいえ カウント 合計 (和) poolId、jobId PT1M はい
Task Requeue イベント

再キューに入ったタスクの合計数
TaskRequeueEvent いいえ カウント 合計 (和) poolId、jobId PT1M はい
タスク スケジュールの失敗イベント

スケジュールに失敗したタスクの合計数
TaskScheduleFailEvent いいえ カウント 合計 (和) poolId、jobId PT1M はい
タスクの開始イベント

開始したタスクの合計数
TaskStartEvent いいえ カウント 合計 (和) poolId、jobId PT1M はい

ノードおよびコア数の指標

リソース割り当てカテゴリのノードおよびコアカウントの指標はゲージ指標です。 各サンプルはバッチアカウントの時点合計を表しており、時間区間のイベント数ではありません。

PT1M時間粒度は、これらの指標が1分単位の粒度を支持していることを示しています。 すべての1分間の間隔に必ず1つのサンプルが含まれている保証はありません。 サンプルが欠けているということは、その区間でメトリック値が報告されなかったことを意味します。それはノードやコア数がゼロだったという意味ではありません。 処理や配送のタイミングによって、同じ間隔内に複数のサンプルが現れることもあります。

ノード数とコア数を分析すると:

  • ノードやコアの数を決めるために トータル アグリゲーションで決めないでください。 Total は選択した区間内のすべてのサンプルを加算し、区間に複数のサンプルが含まれている場合はカウントを過大評価することがあります。
  • 最大値を使えば、区間内で観測されたカウントが最も高いものが表示されます。
  • Averageを使って、報告されたサンプルの平均を区間内で表示してください。
  • これらの指標を、毎分の正確なノード数の権威ある記録やプールの自動スケール評価の監査記録として使わないでください。

メトリック ディメンション

メトリック ディメンションについては、「多次元メトリック」を参照してください。

このサービスでは、次のディメンションがそのメトリックに関連付けられています。

  • poolId
  • jobId
  • 操作
  • 結果

リソース ログ

このセクションでは、このサービス用に収集できるリソース ログの種類を一覧表示します。 このセクションでは、Azure Monitor でサポートされているすべてのリソース ログ カテゴリの種類のリストからプルされます。

Microsoft.Batch/batchaccounts でサポートされているリソース ログ

カテゴリ エクスポートするコスト ログ テーブル 基本ログ プランをサポート インジェスト時間変換をサポート クエリの例
AuditLog はい AzureDiagnostics

複数の Azure リソースからのログ。

いいえ いいえ クエリ
ServiceLog いいえ AzureDiagnostics

複数の Azure リソースからのログ。

いいえ いいえ クエリ

サービス ログ イベント

Batch サービス ログには、プールやタスクなど、個々の Batch リソースの有効期間中に Batch サービスによって生成されるイベントが含まれます。 Batch サービスは、次のログ イベントを出力します。

Batch によって生成された各イベントが、JSON 形式で記録されます。 次の例は、サンプルのプール作成イベントの本文を示しています。

{
    "id": "myPool1",
    "displayName": "Production Pool",
    "vmSize": "Standard_F1s",
    "imageType": "VirtualMachineConfiguration",
    "cloudServiceConfiguration": {
        "osFamily": "",
        "targetOsVersion": ""
    },
    "networkConfiguration": {
        "subnetId": " "
    },
    "virtualMachineConfiguration": {
        "imageReference": {
            "publisher": "Canonical",
            "offer": "UbuntuServer",
            "sku": "20.04-LTS",
            "version": "latest"
        },
        "nodeAgentId": "batch.node.ubuntu 22.04"
    },
    "resizeTimeout": "300000",
    "targetDedicatedNodes": 2,
    "targetLowPriorityNodes": 2,
    "maxTasksPerNode": 1,
    "taskSlotsPerNode": 1,
    "vmFillType": "Spread",
    "enableAutoScale": false,
    "enableInterNodeCommunication": false,
    "isAutoPool": false
}

Azure Monitor ログ テーブル

このセクションでは、Kusto クエリを使用した Log Analytics によるクエリに使用できる、このサービスに関連するすべての Azure Monitor ログ テーブルを一覧表示します。 テーブルにはリソース ログ データが含まれており、収集されルーティングされる内容によっては、さらに多くのデータが含まれる場合があります。

Batch アカウント

microsoft.batch/batchaccounts

アクティビティ ログ

リンクされたテーブルには、このサービスのアクティビティ ログに記録できる操作が一覧表示されます。 これらの操作は、アクティビティ ログで使用可能なすべてのリソース プロバイダー操作のサブセットです。

アクティビティ ログ エントリのスキーマの詳細については、「アクティビティ ログのスキーマ」を参照してください。