GPU VM の監視
GPU Virtual Machine は、ワークロードの監視とトラブルシューティングに役立つメトリクスを提供します。これらのメトリクスはサービスの性能、可用性、リソース使用状況を追跡し、問題の検出と運用の最適化に役立ちます。メトリクスデータは 30 日間保持されます。
メトリクスは 3 つのグループに分かれています。
- Utilization metrics: CPU、メモリ、GPU の使用状況を監視し、システム性能とリソース効率を評価します。
- Disk metrics: ディスクの読み書き速度とレイテンシを追跡し、storage の問題やボトルネックを検出します。
- Network metrics: 読み書きされたデータ量と、その読み書きが発生する頻度を測定します。
追加のメトリクスが必要な場合は、プロバイダーに問い合わせて高度な監視サービスをご検討ください。