Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.
Résolution des problèmes liés à Container Insights sur Amazon EKS
Cette section couvre les problèmes courants que vous pouvez rencontrer lors de la configuration ou de l'utilisation de Container Insights sur Amazon EKS. Utilisez les tableaux et les commandes de diagnostic suivants pour identifier et résoudre les problèmes, que vous utilisiez l'approche OTel ou classique.
Pour obtenir des conseils de configuration spécifiques à l'approche, voir ou. Démarrage rapide : OTel Container Insights sur Amazon EKS Guide de configuration (AWS CLI) Pour comparer les approches, voirComparez les approches de Container Insights.
Les métriques n'apparaissent pas dans CloudWatch
Si aucune métrique n'apparaît dans l'espace de ContainerInsights noms, utilisez le tableau suivant pour en identifier la cause.
| Symptôme | Cause | Résolution |
|---|---|---|
Aucune métrique dans l'espace de ContainerInsights noms |
Le rôle IAM n'est pas autorisé cloudwatch:PutMetricData |
Associez la politique CloudWatchAgentServerPolicy gérée au rôle IAM de l'agent. |
| Les métriques apparaissent pour certains nœuds mais pas pour d'autres | L'agent DaemonSet n'est pas planifié sur tous les nœuds en raison de taches | Ajoutez des tolérances à l'agent DaemonSet pour permettre la planification sur les nœuds contaminés. |
| Les métriques cessent d'apparaître | Le pod de l'agent est détruit par OomKilled ou redémarre | Augmentez les limites de mémoire dans la spécification des ressources du module agent. |
| Les métriques sont périmées ou nulles | La connectivité réseau est bloquée | Vérifiez les groupes de sécurité VPC et vérifiez qu'un point de terminaison CloudWatch VPC existe. |
| Des indicateurs améliorés sont absents | Agent non configuré pour une observabilité améliorée | Défini enhancedObservability: true dans la configuration de l'agent. |
Les modules d'agent ne démarrent pas
Si les modules d'agent ne démarrent pas ou restent inactifs, utilisez le tableau suivant pour diagnostiquer le problème.
| Symptôme | Cause | Résolution |
|---|---|---|
ImagePullBackOff |
Amazon ECR est inaccessible ou le tag de l'image est incorrect | Vérifiez l'URI de l'image et confirmez que vos nœuds peuvent accéder à Amazon ECR. |
Pending |
Processeur ou mémoire insuffisants sur le nœud | Redimensionnez le groupe de nœuds ou réduisez les demandes de ressources dans la spécification du module d'agent. |
CrashLoopBackOff |
Configuration non valide ou montage de volume manquant | Vérifiez les journaux du pod pour détecter les erreurs de configuration en exécutant l'application kubectl logs sur le pod concerné. |
FailedScheduling |
L'affinité ou les entailles des nœuds empêchent la planification | Passez en revue les tolérances nodeSelector et les tolérances indiquées dans les DaemonSet spécifications. |
| Code de sortie 1 | Le compte de service ne contient pas d'annotation IRSA | Vérifiez que le compte de service possède l'eks.amazonaws.com/role-arnannotation. |
Add-on échecs d'installation
Si le amazon-cloudwatch-observability module ne parvient pas à s'installer ou signale un état défectueux, utilisez le tableau suivant pour résoudre les problèmes.
| Symptôme | Cause | Résolution |
|---|---|---|
CREATE_FAILED |
Ressources conflictuelles issues d'une installation précédente | Supprimez les ressources en conflit et --resolve-conflicts OVERWRITE utilisez-les lorsque vous créez le module complémentaire. |
| Fournisseur OIDC introuvable | Aucun fournisseur d'identité IAM OIDC n'existe pour le cluster | Créez le fournisseur en exécutanteksctl utils
associate-iam-oidc-provider. |
| Conflit de versions | Add-on la version est incompatible avec la version de Kubernetes | Répertoriez les versions compatibles en exécutantaws eks
describe-addon-versions. |
État DEGRADED |
Les bilans de santé échouent en raison d'autorisations manquantes | Consultez les journaux du pod et vérifiez que le rôle IRSA est associé aux politiques requises. |
Problèmes de livraison du journal
Si les journaux des conteneurs n'apparaissent pas dans Amazon CloudWatch Logs, utilisez le tableau suivant pour en identifier la cause.
| Symptôme | Cause | Résolution |
|---|---|---|
| Le groupe de journaux n'existe pas | logs:CreateLogGroupAutorisation manquante |
Ajoutez CloudWatch les autorisations Amazon Logs au rôle IAM de l'agent. |
| Le groupe de journaux existe mais est vide | L'agent n'est pas configuré pour les journaux ou les régions ne correspondent pas | Vérifiez que la configuration de l'agent inclut la collecte de journaux et que la région correspond à la région de votre cluster. |
| Les journaux sont retardés de plus de 5 minutes | L'intervalle de rinçage est trop élevé ou le nœud est soumis à une charge importante | Réduisez la force_flush_interval valeur de la configuration de l'agent. |
| Les journaux de performance sont manquants | L'agent est configuré uniquement pour les journaux des applications | Vérifiez que la section du journal des performances de Container Insights est présente dans la configuration de l'agent. |
Migration-specific problèmes
Si vous rencontrez des problèmes lors de la migration entre les approches de Container Insights, utilisez le tableau suivant. Pour le flux de travail de migration complet, voirGuides de migration.
| Symptôme | Cause | Résolution |
|---|---|---|
| Métriques dupliquées lors de l'exécution en parallèle | Les deux approches publient des métriques simultanément | Ce comportement est attendu lors d'une exécution en parallèle. Désactivez l'ancienne approche après avoir validé la nouvelle approche. |
| Valeurs métriques différentes selon les approches | Différentes méthodes de calcul | De légères différences (moins de 5 %) sont attendues. De grandes différences indiquent une inadéquation de configuration entre les approches. |
| Le rollback échoue | La configuration personnalisée n'a pas été réappliquée | Re-apply vos valeurs de configuration complètes lorsque vous revenez en arrière. |
| Les alarmes se déclenchent pendant la migration | Écarts métriques pendant la période de transition | Réglez temporairement le traitement des données manquantes notBreaching sur les alarmes concernées. |
Problèmes d'OTel Container Insights
Les problèmes suivants sont spécifiques à l'approche d'OTel Container Insights. Pour obtenir des instructions générales de configuration, voirDémarrage rapide : OTel Container Insights sur Amazon EKS.
| Symptôme | Cause | Résolution |
|---|---|---|
| 403 Erreur d'exportation interdite | Le rôle IAM ne dispose pas d'autorisations CloudWatch | Vérifiez que le CloudWatchAgentServerPolicy est attaché au rôle d'agent. |
| Connexion refusée sur le point de terminaison des métriques | Le collecteur ne peut pas atteindre le kubelet | Vérifiez que cela hostNetwork: true est défini dans les spécifications du module ou que le compte de service dispose des autorisations requises. |
| Utilisation élevée de la mémoire | La file d'attente du processeur Batch est trop grande | Réduisez les batch/send_batch_size valeurs batch/timeout et dans la configuration du collecteur. |
| Les métriques personnalisées n'apparaissent pas | Le récepteur n'est pas configuré pour le point de terminaison de l'application | Ajoutez un récepteur Prometheus qui cible le port des métriques de votre application dans la configuration du collecteur. |
Commandes de diagnostic générales
Utilisez les commandes suivantes pour recueillir des informations sur votre déploiement de Container Insights.
Pour vérifier l'état du module d'agent, exécutez la commande suivante.
kubectl get pods -n amazon-cloudwatch
Pour consulter les journaux des modules de l'agent, exécutez la commande suivante.
kubectl logs -n amazon-cloudwatch -l app.kubernetes.io/name=cloudwatch-agent --tail=50
Pour vérifier l' DaemonSet état de l'agent, exécutez la commande suivante.
kubectl get daemonset -n amazon-cloudwatch
Pour vérifier le rôle IAM sur un compte de service, exécutez la commande suivante.
kubectl get serviceaccount -n amazon-cloudwatch -o yaml
Pour vérifier l'état du module complémentaire du cluster, exécutez la commande suivante. cluster-nameRemplacez-le par le nom de votre cluster Amazon EKS.
aws eks describe-addon --cluster-namecluster-name--addon-name amazon-cloudwatch-observability
Pour répertorier les groupes de journaux de Container Insights, exécutez la commande suivante. cluster-nameRemplacez-le par le nom de votre cluster Amazon EKS.
aws logs describe-log-groups --log-group-name-prefix "/aws/containerinsights/cluster-name"
Ressources connexes
Pour plus d'informations sur la configuration et le fonctionnement de Container Insights sur Amazon EKS, consultez les rubriques suivantes.
-
Démarrage rapide : OTel Container Insights sur Amazon EKS— Configurer OTel Container Insights
-
Guide de configuration (AWS CLI)— Configurer Classic Container Insights
-
Guides de migration— Migrer entre les approches
-
Comparez les approches de Container Insights— Comparez les approches de Container Insights