Cómo diseñar un roadmap para pasar de SysAdmin a DevOps

Problema Muchos profesionales que han pasado los últimos años gestionando servidores tradicionales sienten que su experiencia está fragmentada: instalaban paquetes repetidamente, seguían SOPs rígidos y apenas tocaron automatización o infraestructura como código. Cuando intentan postular a roles de DevOps, los reclutadores buscan dominio de contenedores, orquestadores, cloud y pipelines CI/CD. El reto es estructurar un plan de estudio que cubra los huecos críticos sin perder tiempo en certificaciones superficiales. Causa Entornos legacy – Empresas con infraestructura monolítica limitan la exposición a herramientas modernas. Falta de proyectos propios – Sin iniciativas de automatización, el aprendizaje queda teórico. Enfoque en tareas operativas – El día a día consume tiempo que podría dedicarse a profundizar en conceptos de infraestructura. Ausencia de mentoría – Sin guía, el autodidactismo se dispersa y se generan lagunas en networking, seguridad y cloud. Solución Diseñar un roadmap modular que combine teoría, práctica y retroalimentación. Cada módulo se apoya en proyectos “hands‑on” que pueden ejecutarse en una laptop o en un entorno de homelab. El objetivo es alcanzar tres hitos: ...

July 17, 2026 · Ernesto

Cómo reparar un ZFS mirror bootable en Proxmox después de reemplazar discos

Problema En entornos de virtualización con Proxmox, es frecuente usar ZFS en modo mirror para el disco del sistema. Cada disco contiene tres particiones típicas: BIOS BOOT, EFI System Partition (ESP) y la partición ZFS. Cuando una de las unidades falla y se sustituye, el proceso de clonar particiones y resilver el pool puede dejar el sistema sin un gestor de arranque funcional. El síntoma clásico es el mensaje de la BIOS “Error 1962: No operating system found” o la ausencia del nuevo disco en la lista de dispositivos de arranque, aunque el pool ZFS sigue saludable. ...

July 17, 2026 · Ernesto

Qué métricas de Grafana incluir en un dashboard de homelab útil

Problema En cualquier homelab que combine varios nodos Proxmox, máquinas virtuales y servicios de monitoreo, el panel de Grafana tiende a convertirse en una hoja de cálculo gigante. Se añaden métricas por curiosidad, se importan dashboards completos y, al final, la vista principal está saturada de gráficas que rara vez indican un problema real. El reto es identificar, de forma reproducible, qué indicadores deben estar presentes en el dashboard de visión general para que sirvan como primer nivel de detección de fallos, sin perder claridad ni generar ruido visual. ...

July 17, 2026 · Ernesto

Cómo diagnosticar y solucionar arranques lentos y consola noVNC congelada en VMs con GPU passthrough

Problema En entornos de virtualización con GPU passthrough es frecuente observar dos síntomas que aparecen de forma intermitente: Arranques de la VM mucho más lentos de lo habitual (30 s → 80 s o más). Congelación de la consola noVNC (y del thumbnail de Proxmox) en una única línea de texto durante varios segundos, mientras que la VM sigue funcionando y el acceso por SSH permanece operativo. Estos síntomas aparecen solo cuando la GPU dedicada está conectada a la VM; si se arranca sin la tarjeta, el tiempo de boot vuelve a la normalidad y la consola noVNC nunca se bloquea. La aleatoriedad es típica: el mismo guest, mismo kernel y misma configuración pueden producir un arranque “bueno” o “malo” sin que el administrador pueda predecir cuál será. ...

July 16, 2026 · Ernesto

Monitorizar servidores Linux vía SSH sin agentes y gestionar Docker desde Android

Problema En entornos con varios VPS o servidores bare‑metal, la tendencia es desplegar un agente de monitorización (Prometheus node‑exporter, Zabbix agent, etc.). Cada agente implica instalación, mantenimiento de paquetes, apertura de puertos y, a menudo, exposición de datos a un backend externo. Cuando los recursos son escasos o la política de seguridad prohíbe procesos adicionales, esa aproximación resulta poco práctica. El desafío consiste en obtener métricas de estado (CPU, memoria, uso de disco, tráfico de red) y, de paso, ejecutar comandos o gestionar contenedores sin tocar el servidor con software adicional, todo desde un dispositivo móvil. ...

July 16, 2026 · Ernesto

Cómo diagnosticar y solucionar problemas de búsqueda de keyring de Ceph en Proxmox VE

Problema En entornos con Proxmox VE (PVE) conectado a un clúster Ceph externo, es frecuente que operaciones que requieren acceso a RBD –por ejemplo, eliminar o migrar máquinas virtuales– fallen con mensajes como rbd: listing images failed: (2) No such file or directory o Permission denied. El origen suele ser que el cliente rbd no encuentra un keyring válido para autenticarse contra Ceph. Cuando la búsqueda automática de keyring cambia o los archivos esperados desaparecen, PVE deja de poder ejecutar comandos rbd, lo que se traduce en errores en la interfaz web y en scripts de automatización. ...

July 14, 2026 · Ernesto

Cómo diseñar y optimizar un homelab con GPUs, NVMe y Proxmox

Problema Los entusiastas de la infraestructura casera suelen combinar servidores antiguos, tarjetas aceleradoras y discos de alta velocidad para ejecutar cargas de trabajo de IA, contenedores y servicios de respaldo. Cuando la arquitectura incluye varios tipos de CPU (EPYC, Xeon, Power8), GPUs de consumo (RTX 3090) y GPUs de centro de datos (Tesla P100, A2), además de almacenamiento NVMe, SAS y cintas LTO, la complejidad de la gestión crece rápidamente. Los síntomas típicos son: ...

July 14, 2026 · Ernesto

Cómo prepararse para entrevistas de Infrastructure Engineer: Linux, Ansible y networking

Problema Los ingenieros de infraestructura suelen recibir invitaciones a entrevistas que combinan preguntas de alto nivel (cultura, procesos) y pruebas técnicas muy específicas (Apache, MySQL, NFS, LDAP, etc.). El reto es demostrar dominio suficiente sin haber trabajado intensivamente con cada tecnología en un entorno empresarial, y hacerlo todo a través de videollamadas donde la comunicación no verbal se pierde. El entrevistado necesita estructurar su preparación, anticipar los temas más probables y proyectar confianza sin caer en respuestas superficiales. ...

July 14, 2026 · Ernesto

Mejores prácticas de security y VLAN para Proxmox en un home lab

Problema En muchos home labs la seguridad se queda en “activar 2FA y listo”. Cuando el número de VMs crece, esa capa mínima deja expuestos puntos críticos: la interfaz de gestión de Proxmox, los servidores de almacenamiento y, sobre todo, los backups. Un atacante que compromete una VM puede saltar a la red de gestión, robar credenciales SSH o cifrar los snapshots si los backups no son inmutables. El patrón recurrente es la falta de segmentación de tráfico y de controles de acceso estrictos, lo que convierte a un entorno doméstico en un objetivo fácil para ransomware o para movimientos laterales dentro de la red. ...

July 14, 2026 · Ernesto

Cómo solucionar problemas de cloud-init en Proxmox

Problema En entornos de virtualización con Proxmox es frecuente crear plantillas de máquinas virtuales (VM) basadas en imágenes cloud‑ready y usar la unidad cloud‑init para provisionar usuarios, claves SSH y configuración de red. Cuando la VM arranca, el usuario definido con ciuser no aparece y la clave pública no permite el acceso por SSH. El agente de QEMU tampoco se registra, lo que impide inspeccionar la VM desde el host. El síntoma típico es un login local que muestra el usuario por defecto de la imagen (por ejemplo fedora) y una dirección IP asignada por DHCP, pero sin ningún rastro de la configuración de cloud‑init. ...

July 13, 2026 · Ernesto