Saltar al contenido

¿Cómo soluciono los errores de comprobación de estado en mi instancia de Amazon EC2?

6 minutos de lectura
0

Mi instancia de Amazon Elastic Compute Cloud (Amazon EC2) no pasó una o más comprobaciones de estado.

Descripción corta

Amazon EC2 utiliza tres comprobaciones de estado para supervisar el estado de las instancias de EC2:

Importante: Algunas resoluciones de comprobación de estado requieren que detengas e inicies la instancia. Un reinicio mantiene la instancia en el mismo host físico. Para migrar a un hardware nuevo, debes detener e iniciar la instancia.

Resolución

Primero, consulta las métricas de comprobación de estado de la instancia para identificar la comprobación de estado que falló. A continuación, realiza las siguientes acciones en función de la comprobación de estado que falló.

Configuración de la instancia para que se detenga e inicie

Nota: Al detener e iniciar una instancia, la dirección IP pública de la instancia cambia. Se recomienda utilizar una dirección IP elástica para enrutar el tráfico externo hacia la instancia en lugar de una dirección IP pública. Si usas Amazon Route 53, es posible que tengas que actualizar los registros DNS de Route 53 cuando cambies la dirección IP pública. Parar e iniciar es diferente al reinicio de una instancia. Para obtener más información, consulta Cómo funciona la detención y el inicio de las instancias de EC2.

Antes de detener e iniciar la instancia, lleva a cabo las siguientes acciones:

Solución de errores en la comprobación del estado del sistema

Los errores en la comprobación del estado del sistema se producen cuando hay problemas con la infraestructura subyacente en la que se ejecuta la instancia.

Para solucionar errores en la comprobación del estado del sistema, consulta el panel de AWS Health para ver si hay interrupciones del servicio en la región de AWS en la que se encuentra tu instancia.

Si no hay interrupciones, significa que existe un problema con el host subyacente de la instancia. Para solucionar este problema, completa los siguientes pasos para migrar la instancia a un nuevo host subyacente:

  1. Detén la instancia.
    Nota: Si la instancia está bloqueada en el estado dedetención, puedes forzar su detención. Esta acción puede tardar hasta 10 minutos.
  2. Inicia la instancia.

Para recuperar automáticamente las instancias que no superen las comprobaciones de estado del sistema, configura la recuperación automática de instancias.

Importante: Una parada forzada no vacía las cachés del sistema de archivos y puede provocar la pérdida o corrupción de los datos. Tras reiniciar, ejecuta los siguientes comandos en función de tu sistema operativo (SO) para comprobar si hay errores de coherencia en el sistema de archivos.

Linux:

fsck

Windows:

chkdsk
sfc /scannow	

El comando chkdsk comprueba el sistema de archivos y los metadatos del sistema de archivos del volumen en busca de errores lógicos y físicos. El comando sfc /scannow comprueba si los sistemas de archivos están dañados. Para obtener más información, consulta chkdsk y Usar el Comprobador de archivos de sistema en Windows en el sitio web de Microsoft.

Solución de errores en la comprobación del estado de las instancias

Las comprobaciones del estado de las instancias identifican problemas con el sistema operativo, la configuración de la red y el uso de los recursos. Para solucionar errores en la comprobación del estado de la instancia, usa los siguientes recursos según el sistema operativo de la instancia:

Solución de errores de comprobación de estado de EBS adjuntos

Si tu instancia no pasa la comprobación de estado de EBS adjunta, comprueba la métrica VolumeStalledIOCheck en Amazon CloudWatch para ver el volumen afectado. Si el valor es 1, el volumen tiene problemas. Por lo general, Amazon EBS diagnostica y recupera automáticamente el volumen en unos minutos. Para obtener más información, consulta Características y supervisión de E/S de Amazon EBS.

Para validar que el volumen se ha recuperado, comprueba si ese VolumeStalledIOCheck cambia a un valor de 0 0.

Si el problema persiste, detén e inicia la instancia para migrarla a un nuevo host. Si un volumen específico sigue teniendo problemas después del reinicio, debes reemplazar el volumen. Crea una instantánea del volumen y, a continuación, crea un nuevo volumen a partir de la instantánea. Usa el nuevo volumen para reemplazar el volumen existente.

Información relacionada

Solución de problemas de una instancia de Amazon EC2 inaccesible

OFICIAL DE AWSActualizada hace 6 meses