View a markdown version of this page

Puestos de trabajo bloqueados en RUNNABLE debido a la capacidad - AWS Batch

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

Puestos de trabajo bloqueados en RUNNABLE debido a la capacidad

El siguiente escenario describe cómo se AWS Batch identifican las condiciones de capacidad insuficiente.

Capacidad de instancia insuficiente

AWS Batch interpreta dos conjuntos de respuestas recibidas por SageMaker Training Jobs como casos de capacidad de instancia insuficiente. Siempre que se reciban, AWS Batch establece un número correspondiente statusReason deCAPACITY:INSUFFICIENT_INSTANCE_CAPACITY.

En ambos casos, el tiempo transcurrido entre la presentación del AWS Batch trabajo correspondiente y su rechazo se acumula SCHEDULED entre la presentación del trabajo y la presentación del mismo con fines comparativosmaxTimeSeconds.

Escenario

TrainingJobStatus

Indicador

El trabajo de entrenamiento falla por un error de capacidad

FAILED

failedReasoncomienza con CapacityError

El trabajo de formación agota el tiempo de espera al aforo

STOPPED

secondaryStatusindica que el trabajo ha agotado el tiempo de espera en espera de capacidad

Si se da alguno de estos casos, AWS Batch considerará que la capacidad del trabajo es insuficiente.

  • Mensaje de statusReason mientras el trabajo está atascado: CAPACITY:INSUFFICIENT_INSTANCE_CAPACITY - Unable to provision requested compute resources

  • reason utilizado para jobStateTimeLimitActions: CAPACITY:INSUFFICIENT_INSTANCE_CAPACITY

  • statusReasonmensaje tras la finalización del trabajo mediantejobStateTimeLimitActions: Terminated by JobStateTimeLimit action due to reason: CAPACITY:INSUFFICIENT_INSTANCE_CAPACITY