View a markdown version of this page

Tâches bloquées dans RUNNABLE en raison de la capacité - AWS Batch

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.

Tâches bloquées dans RUNNABLE en raison de la capacité

Le scénario suivant décrit comment AWS Batch identifier les conditions de capacité insuffisante.

Capacité d'instance insuffisante

AWS Batch interprète deux séries de réponses reçues par SageMaker Training jobs comme des cas de capacité d'instance insuffisante. Chaque fois qu'ils sont reçus, AWS Batch définit un correspondant statusReason deCAPACITY:INSUFFICIENT_INSTANCE_CAPACITY.

Dans les deux cas, le temps passé par le AWS Batch poste correspondant SCHEDULED entre sa soumission et son échec s'accumule entre les soumissions à des fins de comparaison. maxTimeSeconds

Scénario

TrainingJobStatus

Indicateur

La tâche de formation échoue en raison d'une erreur de capacité

FAILED

failedReasoncommence par CapacityError

Le travail de formation prend fin dans l'attente d'une capacité

STOPPED

secondaryStatusindique que le délai imparti pour la tâche a expiré en attente de capacité

Si l'un de ces cas est atteint, AWS Batch je considérerai que la tâche présente une capacité insuffisante.

  • statusReasonmessage lorsque la tâche est bloquée : CAPACITY:INSUFFICIENT_INSTANCE_CAPACITY - Unable to provision requested compute resources

  • reasonutilisé pour jobStateTimeLimitActions : CAPACITY:INSUFFICIENT_INSTANCE_CAPACITY

  • statusReasonmessage après la fin de la tâche par jobStateTimeLimitActions : Terminated by JobStateTimeLimit action due to reason: CAPACITY:INSUFFICIENT_INSTANCE_CAPACITY