Cómo gestionar un servidor bare‑metal desde la terminal con una TUI

Problema En entornos homelab o servidores de pequeña escala, el flujo típico de administración consiste en abrir una sesión SSH, ejecutar apt update, inspeccionar el uso de disco, listar puertos con ss -tuln, revisar contenedores Docker y, finalmente, volver a cerrar la sesión. Cada paso implica cambiar de herramienta, copiar y pegar resultados y, a menudo, olvidar alguna pieza del puzzle. El tiempo invertido en “ir y venir” entre comandos se vuelve significativo y el riesgo de pasar algo por alto (un servicio sin iniciar, una regla de firewall deshabilitada) aumenta. El problema subyacente es la falta de una vista consolidada que permita observar y actuar sobre los componentes críticos del servidor sin abandonar la terminal. ...

June 28, 2026 · Ernesto

Cómo preparar entrevistas early‑career de Linux/Fleet Ops: áreas de escenario prioritarias

Problema Los candidatos a roles de Linux/Fleet Ops, SRE o infraestructura suelen recibir una lista de temas (troubleshooting, networking, storage, scripting) pero no saben cómo priorizar su estudio. El reto es convertir esa lista en una ruta de preparación que maximice la probabilidad de resolver los escenarios que los entrevistadores plantean, sin perder tiempo en detalles que rara vez aparecen en entrevistas early‑career. Causa Entrevistas basadas en escenarios reales – Los entrevistadores buscan observar el proceso de diagnóstico, no la memorización de comandos aislados. Amplio espectro de conocimientos – Linux, redes, SAN/NFS y algoritmos de programación compiten por el mismo tiempo de estudio, lo que genera dispersión. Expectativas poco claras – Algunas empresas enfatizan la escritura de código, otras la capacidad de leer logs o de interpretar métricas de rendimiento. Sobre‑preparación en áreas de bajo impacto – Es fácil caer en la trampa de repasar cada flag de iptables o cada versión de systemd cuando la entrevista solo tocará los conceptos básicos. Solución 1. Construir un mapa de “escenarios críticos” Agrupa los temas en cuatro bloques de acción que se alinean con la mayoría de entrevistas early‑career: ...

June 28, 2026 · Ernesto

Cómo solucionar errores de creación de EC2 Instance en AWS

Problema En entornos de infraestructura como código (IaC) es frecuente que el despliegue de una EC2 Instance falle con un mensaje de error 400 que indica que la cuenta está bloqueada o no es reconocida como válida. El mensaje típico incluye “Blocked: This account is currently blocked and not recognized as a valid account”. El fallo ocurre tanto con Terraform como con la consola web, y se presenta antes de que se alcance cualquier límite de cuota o de capacidad. El síntoma es inmediato: la llamada RunInstances devuelve un error y la instancia nunca se crea. ...

June 27, 2026 · Ernesto

Cómo evitar que “works in my Azure subscription” no sea desplegable en Azure

Problema En muchos proyectos de IA y micro‑servicios en Azure se construye un entorno que funciona perfectamente en la suscripción del autor, pero falla al intentar replicarlo en una cuenta limpia. El patrón típico es que la infraestructura depende de configuraciones implícitas: extensiones de PostgreSQL ya instaladas, nombres de secretos que coinciden con recursos creados manualmente, o rutas de archivos locales que sólo existen en la máquina del desarrollador. Cuando otro equipo o un pipeline de CI/CD intenta desplegar el mismo código, aparecen errores de “resource not found”, “invalid secret name” o “extension not allowed”. El resultado es una solución que no es verdaderamente portable y que requiere intervención manual para cada nueva suscripción. ...

June 23, 2026 · Ernesto

Cómo habilitar Maintenance Mode y Rolling Updates nativos en Proxmox

Problema En entornos de alta disponibilidad basados en Proxmox, los administradores suelen necesitar: Poner un nodo en modo de mantenimiento con un solo clic y que todas las máquinas virtuales (VMs) o contenedores (CTs) se reubiquen automáticamente. Ejecutar actualizaciones de nodo de forma rodante, de modo que mientras un host se reinicia para aplicar parches, sus cargas de trabajo continúen operando en los demás nodos del clúster. En la versión actual del GUI de Proxmox estas acciones solo están disponibles mediante la línea de comandos. La ausencia de un botón “Maintenance” y de un flujo de actualización integrado obliga a scripts externos o a herramientas de terceros, lo que complica la automatización y la consistencia en entornos productivos. ...

June 22, 2026 · Ernesto

Cómo automatizar snapshots de VMs en Proxmox

Problema En infraestructuras basadas en Proxmox es frecuente necesitar un punto de restauración rápido antes de operaciones programadas (actualizaciones de contenedores, despliegues de software o cambios de configuración). Los backups tradicionales son seguros pero tardan varios minutos y, al restaurarlos, los discos externos o dispositivos USB pueden quedar desvinculados, obligando a una re‑asociación manual. Un snapshot de la VM captura el estado completo del disco y la configuración en segundos, facilitando una reversión inmediata. El reto consiste en crear snapshots de forma programada, sin interferir con los backups existentes y garantizando que la retención sea manejable. ...

June 19, 2026 · Ernesto

Cómo evitar que Windows Event Forwarding quede Inactive después de apagados prolongados

Problema En entornos donde se usan suscripciones source‑initiated de Windows Event Forwarding (WEF), es frecuente observar que la recolección de eventos funciona sin interrupciones mientras los equipos permanecen encendidos. El punto crítico aparece cuando tanto el colector como los endpoints se apagan durante varios días y, al volver a encenderse, la suscripción pasa a estado Inactive y no se reactiva automáticamente. Los intentos de “Retry” desde el visor de eventos no cambian nada y la única forma de volver a recibir eventos es eliminar la suscripción y crear una nueva. El síntoma se manifiesta con errores de WinRM (códigos 1311, 0x80090311) y mensajes que indican que el “event source is in either disable or inactive state”. ...

June 19, 2026 · Ernesto

Cómo gestionar repositorios de contraseñas en entornos IT: guía de security y compliance

Problema En muchas organizaciones el personal de Recursos Humanos (HR) considera que las credenciales de los usuarios corporativos son un “activo de IT” que pueden y deben centralizarse en un archivo accesible. La petición suele venir acompañada de argumentos como “facilita la recuperación” o “evita tickets repetidos”. En la práctica, esa práctica rompe con los principios básicos de security y privacy, genera un punto único de falla y expone a la empresa a auditorías negativas. El problema se vuelve crítico cuando: ...

June 19, 2026 · Ernesto

Cómo desactivar WSUS en servidores Windows y migrar a Azure Update Manager

Problema En entornos mixtos es frecuente migrar los servidores de un WSUS interno a soluciones basadas en la nube (Intune, Azure Update Manager). La migración suele implicar cambios en GPOs y en la configuración del agente de Windows Update. Cuando el proceso queda incompleto, los servidores continúan intentando contactar al WSUS eliminado: aparecen errores de conexión en los logs, los clientes no reciben actualizaciones de la nueva fuente y el tráfico de red sigue dirigido a una dirección que ya no existe. El síntoma más visible es la presencia de la clave WSUSServer en el registro del equipo o la aparición de eventos “Windows Update client was unable to download the update”. ...

June 17, 2026 · Ernesto

Cómo solucionar problemas de BitLocker y Secure Boot tras actualizaciones de Windows 11

Problema Después de aplicar un Cumulative Update (CU) de Windows 11, una parte significativa de los equipos gestionados con Intune dejan de desbloquearse automáticamente. Los usuarios reciben mensajes de error al iniciar, el sistema solicita la clave de recuperación de BitLocker y, en algunos casos, el arranque se detiene porque el firmware no reconoce el certificado de Secure Boot que Intune había distribuido. El patrón típico es: Un lote de 30‑+ dispositivos que antes funcionaban sin incidentes. El CU se instala automáticamente (a través de Windows Update o WSUS). Al reiniciar, el TPM no entrega la clave de desbloqueo y el proceso de arranque se bloquea. La consola de Intune muestra que el certificado de Secure Boot está “applied”, pero el firmware lo ignora. Este comportamiento rompe la política de “Zero‑Touch” y obliga a los administradores a recuperar manualmente claves, suspender BitLocker o incluso reinstalar el sistema. ...

June 17, 2026 · Ernesto