Problema

Los sistemas Windows 11 que presentan pantallas azules (BSOD) de forma esporádica comparten un patrón reconocible: el equipo se congela, muestra un mensaje de error con un porcentaje de carga detenido en 0 % y se apaga sin generar un volcado completo. Los códigos de parada más habituales son UNEXPECTED_STORE_EXCEPTION, CRITICAL_PROCESS_DIED y KMODE_EXCEPTION_NOT_HANDLED. El fallo ocurre tanto bajo carga pesada (juegos, benchmarks) como en situaciones de bajo uso (navegación web). Los eventos de Kernel-Power y volmgr aparecen en el visor de eventos, indicando que el sistema no pudo escribir el dump antes de perder energía.

Este comportamiento no está limitado a una configuración específica; cualquier PC reciente con CPU/GPUs de última generación, memoria DDR5 y SSD NVMe puede verse afectado cuando alguna capa de hardware o controlador falla de forma intermitente.

Causa

1. Memoria defectuosa o configurada fuera de especificaciones

Los módulos DDR5 a 6000 MHz suelen requerir ajustes de voltaje y latencias. Un perfil XMP/EXPO mal calibrado genera errores de acceso a memoria que se traducen en UNEXPECTED_STORE_EXCEPTION.

2. SSD con firmware problemático o controlador corrupto

Los discos NVMe que no reportan correctamente su tiempo de actividad pueden provocar fallos del gestor de volúmenes (volmgr). Un firmware desactualizado o una tabla de particiones dañada también desencadena KMODE_EXCEPTION_NOT_HANDLED.

3. Controladores de chipset o GPU desincronizados

Los drivers de AMD (chipset y GPU) que no coinciden con la versión del BIOS pueden provocar interrupciones de nivel kernel. La combinación de un driver de GPU reciente y un chipset antiguo es una causa frecuente de CRITICAL_PROCESS_DIED.

4. Fuente de alimentación insuficiente o inestable

Aunque el PSU tenga suficiente wattage nominal, la entrega de energía en los rieles de 12 V puede ser irregular bajo picos de carga, provocando reinicios bruscos que el sistema interpreta como un apagado inesperado.

5. BIOS desactualizado o configuraciones de ahorro de energía agresivas

Opciones como “Power Saving Mode” para PCIe o “Link State Power Management” pueden desactivar temporalmente dispositivos críticos, generando errores de acceso a disco o memoria.

Solución

Paso 1 – Verificar y ajustar la memoria

  1. Desactivar XMP/EXPO y fijar la frecuencia a la velocidad base (ej. 4800 MHz).
  2. Ejecutar MemTest86 desde un USB arrancable durante al menos 8 h. Anotar cualquier error; si aparecen, sustituir el módulo o probar en ranura distinta.
  3. Si la prueba pasa, volver a habilitar XMP con voltajes manuales (por ejemplo, +0.05 V) y volver a testear.

Paso 2 – Auditar el SSD

  1. Descargar la herramienta oficial del fabricante y actualizar el firmware.
  2. Ejecutar smartctl para revisar atributos críticos:
smartctl -a /dev/nvme0
  1. Si el atributo “Power‑On Hours” está estancado o aparecen sectores reasignados, considerar un respaldo completo y reinstalación del sistema en otro disco.

Paso 3 – Sincronizar controladores y BIOS

  1. Instalar la última versión del chipset AMD desde la página oficial.
  2. Descargar el driver de GPU AMD Radeon Software versión estable (no beta).
  3. Actualizar el BIOS a la versión más reciente que incluya mejoras de compatibilidad con DDR5 y NVMe.
  4. En la BIOS, desactivar “Fast Boot” y “PCIe Power Management” para eliminar variables de ahorro de energía.

Paso 4 – Probar la fuente de alimentación

  1. Conectar un multímetro o usar un Power Supply Tester para confirmar que los rieles de 12 V mantienen al menos 5 % de margen bajo carga.
  2. Si el PSU es modular, reconectar los cables críticos (CPU, GPU) directamente al conector del chasis.
  3. En caso de duda, sustituir temporalmente por un PSU de referencia de 750 W.

Paso 5 – Aislar componentes

  1. Arrancar con solo la GPU integrada (si el CPU la tiene) o con una GPU de reserva.
  2. Ejecutar pruebas de estrés (Prime95, AIDA64) para observar si el BSOD reaparece.
  3. Si el sistema se mantiene estable, el problema probablemente reside en la GPU o en la interacción entre GPU y controlador.

Paso 6 – Habilitar generación de dump completo

  1. En Sistema → Configuración avanzada → Inicio y recuperación, seleccionar “Volcado de memoria completo”.
  2. Reiniciar y, si ocurre otro BSOD, analizar el archivo MEMORY.DMP con WinDbg para obtener la pila de llamadas exacta.

Cuándo aplicar esta solución

  • Síntomas: BSOD con códigos de parada de kernel, eventos Kernel-Power y volmgr, pantalla congelada antes de apagar.
  • Aplicable: PCs con Windows 11, DDR5, SSD NVMe y GPUs modernas.
  • No aplicable: Sistemas que ya presentan errores de hardware evidentes (p.ej., pantalla negra sin POST) o que usan versiones de Windows anteriores a 10, ya que los controladores y BIOS pueden variar significativamente.

Código

# Actualizar firmware del SSD (ejemplo Samsung Magician CLI)
magiciancli.exe --update-firmware /dev/nvme0

# Ejecutar diagnóstico de memoria con Windows Memory Diagnostic (modo offline)
mdsched.exe

# Reiniciar el controlador de red para descartar conflictos de IRQ (opcional)
netsh int ip reset

Verificación

  1. Reproducir la carga: ejecutar un benchmark de CPU/GPU (3DMark) durante 30 min.
  2. Monitorear temperaturas: usar HWInfo para confirmar que CPU < 80 °C y GPU < 70 °C.
  3. Revisar el visor de eventos: ausencia de Kernel-Power y volmgr después de la prueba indica éxito.
  4. Comprobar dump: si se genera MEMORY.DMP, abrirlo con WinDbg y buscar la línea “BugCheck” sin códigos de error críticos.

Notas adicionales

  • En configuraciones con PCIe 5.0, algunos SSD pueden requerir una ranura de velocidad reducida (PCIe 4.0) para evitar incompatibilidades de señal.
  • La opción de “Fast Startup” en Windows a veces impide que los controladores se reinicialicen correctamente; desactivarla ayuda en sistemas que presentan BSOD tras reinicios rápidos.
  • Mantener un registro de cambios (driver, BIOS, firmware) facilita la correlación entre una actualización y la aparición del error.