Cómo migrar de ESXi a Harvester y adoptar cattle con Terraform y GitOps

Problema Muchos administradores de homelab mantienen sus entornos sobre hipervisores tradicionales (por ejemplo, ESXi) y gestionan máquinas virtuales como “mascotas”. Cada VM se crea manualmente, se le asignan recursos a mano y su configuración se mantiene fuera de cualquier sistema declarativo. Con el tiempo, esa práctica genera tres síntomas recurrentes: Ansiedad operativa – siempre está la duda de si una VM va a fallar porque su estado no está versionado. Dificultad de replicación – clonar una configuración implica copiar discos, scripts y documentación dispersa. Escalabilidad limitada – añadir una nueva instancia requiere repetir los mismos pasos manuales, lo que aumenta la probabilidad de errores. El reto consiste en migrar a una arquitectura donde los recursos son “cattle”: plantillas inmutables, despliegues reproducibles y todo el ciclo gestionado por código. La solución típica combina un hipervisor basado en Kubernetes (Harvester), infraestructura como código (Terraform), orquestación de configuración (Ansible) y GitOps (Fleet, ArgoCD, etc.). ...

July 11, 2026 · Ernesto

Cómo solucionar despliegues de Azure Arc vía GPO que aparecen como “Task Completed” pero fallan silenciosamente

Problema En entornos con cientos de servidores Windows, es habitual usar Group Policy (GPO) para automatizar la instalación de agentes, extensiones o componentes de Azure Arc. El flujo típico consiste en crear una tarea programada que ejecuta el instalador, dejar que el cliente reporte “Task Completed” y, después, validar que el recurso aparece en el portal de Azure. Lo que muchos administradores descubren demasiado tarde es que el mensaje “Task Completed” no garantiza que el agente haya quedado operativo. Los servidores aparecen como “onboarded” en los registros de GPO, la tarea se elimina y los logs de Azure Arc no muestran errores, pero el agente nunca se registra en Azure. El resultado son servidores “fantasma” que siguen fuera del control de políticas, de Monitor o de Defender for Cloud. ...

July 9, 2026 · Ernesto

Cómo solucionar fallos silenciosos al desplegar Azure Arc mediante GPO

Problema En entornos donde se usa Group Policy (GPO) para automatizar el onboarding de Azure Arc, es frecuente ver que la tarea programada finaliza con el estado Task Completed y, sin errores visibles en los logs, los servidores simplemente no aparecen en el portal de Azure. El cliente percibe que la instalación “se ejecutó” porque la tarea desaparece y los archivos de configuración (por ejemplo ArcInfo.json) se generan, pero la máquina sigue fuera del alcance de Azure Arc, Defender for Cloud y cualquier política basada en la nube. ...

July 9, 2026 · Ernesto

Cómo evitar que el PIN de Windows Hello for Business Key Trust deje de funcionar por sincronización de msDS-KeyCredentialLink

Problema En entornos donde Windows Hello for Business (WHfB) se despliega con el modelo Key Trust y la autoridad de autenticación es ADFS, es frecuente que el PIN funcione al iniciar sesión y, tras unos minutos, deje de hacerlo. El síntoma típico es el mensaje “Sign‑in option temporarily unavailable” después de que el equipo solicite bloquear la sesión para refrescar credenciales. El error se refleja en los logs de Kerberos con el código 0x4B KDC_ERR_CLIENT_NOT_TRUSTED, indicando que el KDC no reconoce la clave usada por WHfB. ...

July 8, 2026 · Ernesto

Cómo implementar un agente de auto‑curación para contenedores Docker

Problema En entornos de producción con contenedores Docker, los fallos inesperados (por ejemplo, procesos que se detienen, puertos que dejan de responder o configuraciones que quedan corruptas) pueden pasar desapercibidos hasta que un cliente experimenta un error. Cuando el orquestador no está configurado para reiniciar automáticamente (por política, por falta de restart: always o porque el contenedor forma parte de un sandbox de pruebas), el estado fallido persiste y el servicio queda inoperativo. ...

July 8, 2026 · Ernesto

Cómo desplegar un Discord bot para capturar MHTML y respaldar sitios web en un NAS

Problema En entornos de auto‑hosting es frecuente querer ofrecer a los usuarios una forma sencilla de archivar páginas web sin salir de Discord. El patrón típico consiste en: Un bot que recibe una URL a través de un mensaje. El bot abre la página con un motor sin cabeza, genera un archivo MHTML y lo guarda en un almacenamiento permanente. Los obstáculos aparecen cuando el bot necesita escribir en un NAS o en otro recurso compartido, cuando las dependencias del motor sin cabeza son incompatibles con la distribución del servidor, o cuando el proceso se cae al cerrar la sesión SSH. En muchos casos el bot funciona en pruebas locales pero falla en producción por problemas de montaje, versiones de Node, o gestión de procesos. ...

July 7, 2026 · Ernesto

Cómo mantener la profundidad de SRE y avanzar en tu carrera cuando estás atrapado en un rol de soporte L1/L2

Problema Muchos ingenieros con varios años de experiencia en SRE terminan en equipos de soporte L1/L2 después de una reestructuración o un contrato “seguro”. El día a día se reduce a tickets, runbooks y escalados, sin oportunidad de diseñar pipelines, escribir código de automatización o definir SLO/SLI. Con el tiempo el currículum muestra una brecha entre la experiencia real y la que el mercado espera para roles senior (L4/L5, Platform Engineer). El desafío es doble: seguir adquiriendo profundidad técnica mientras se mantiene la empleabilidad y se prepara una narrativa que no penalice el periodo de soporte. ...

July 7, 2026 · Ernesto

Cómo centralizar la gestión de Redis, PostgreSQL, Docker y otros servicios con una única TUI y servidor JSON‑RPC

Problema Los equipos de operaciones suelen trabajar con una colección heterogénea de herramientas: redis-cli para Redis, psql o mysql para bases de datos, ssh para acceso remoto, docker para contenedores, git para control de versiones y clientes HTTP para APIs. Cada una tiene su propio flujo de autenticación, su propio formato de salida y, sobre todo, su propia ventana de terminal. El “cambio de contexto” constante genera: pérdida de tiempo al abrir y cerrar sesiones, dificultad para correlacionar logs de diferentes fuentes, riesgo de que credenciales se propaguen en archivos temporales, complejidad al automatizar tareas con scripts que deben invocar múltiples binarios. En entornos donde se combinan bases de datos, servicios de almacenamiento S3, despliegues vía SSH y pipelines de CI, el problema se vuelve crítico: cualquier interrupción en una herramienta rompe la cadena de trabajo y obliga a volver a autenticarse o a replicar configuraciones. ...

July 6, 2026 · Ernesto

Cómo ajustar la frecuencia de búsqueda de actualizaciones en Windows Server en Azure y on‑prem

Problema En entornos mixtos es habitual que los servidores Windows Server en Azure y los que corren en data‑center propio compartan la misma política de actualizaciones mediante GPO y Azure Update Management. Sin embargo, muchos administradores observan que los equipos en Azure ejecutan la comprobación de actualizaciones solo unas cuantas veces al día, mientras que los servidores on‑prem lo hacen casi cada hora. Esta disparidad genera ventanas de exposición mayores en la nube y complica la planificación de parches coordinados entre sitios. ...

July 4, 2026 · Ernesto

Cómo ajustar la frecuencia de Windows Update en Azure Windows Server

Problema En entornos mixtos (on‑premise y Azure) es frecuente observar que los servidores Windows Server en Azure realizan la comprobación de actualizaciones con una periodicidad distinta a la de los mismos servidores en datacenters propios. Mientras que los equipos locales pueden estar configurados para buscar actualizaciones cada hora, los VMs en Azure a menudo aparecen con solo unas cuantas consultas al día. El síntoma se manifiesta en los logs de Windows Update, en el historial de WSUS/Azure Update Manager y en la consola de GPO donde la política parece idéntica en ambos grupos. ...

July 4, 2026 · Ernesto