View a markdown version of this page

Trabalhos paralisados em RUNNABLE devido à capacidade - AWS Batch

As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.

Trabalhos paralisados em RUNNABLE devido à capacidade

O cenário a seguir descreve como AWS Batch identifica condições de capacidade insuficiente.

Capacidade de instância insuficiente

AWS Batch interpreta dois conjuntos de respostas recebidas pelos trabalhos de SageMaker treinamento como casos de capacidade de instância insuficiente. Sempre que forem recebidos, AWS Batch define um correspondente statusReason deCAPACITY:INSUFFICIENT_INSTANCE_CAPACITY.

Em ambos os casos, o tempo gasto pelo AWS Batch trabalho correspondente SCHEDULED entre o envio do trabalho e a falha se acumula entre os envios do trabalho para comparação. maxTimeSeconds

Cenário

TrainingJobStatus

Indicador

O trabalho de treinamento falha com erro de capacidade

FAILED

failedReasoncomeça com CapacityError

O trabalho de treinamento expira à espera de capacidade

STOPPED

secondaryStatusindica que o tempo limite do trabalho foi atingido em espera pendente pela capacidade

Se algum desses casos for atingido, AWS Batch considerará que o trabalho está com capacidade insuficiente.

  • Mensagem do statusReason enquanto o trabalho está travado: CAPACITY:INSUFFICIENT_INSTANCE_CAPACITY - Unable to provision requested compute resources

  • reason usado para jobStateTimeLimitActions: CAPACITY:INSUFFICIENT_INSTANCE_CAPACITY

  • statusReasonmensagem após o término do trabalho por: jobStateTimeLimitActions Terminated by JobStateTimeLimit action due to reason: CAPACITY:INSUFFICIENT_INSTANCE_CAPACITY