Cómo identificar al propietario de recursos AWS sin tags fiables

Problema En entornos con varios equipos, es habitual encontrarse con recursos de AWS que carecen de tags de propietario o que presentan información desactualizada. La ausencia de metadatos fiables dificulta responder preguntas como: ¿Quién creó esta instancia EC2?, ¿A qué proyecto pertenece este bucket S3? o ¿Quién mantiene este rol IAM? La falta de claridad genera retrasos en auditorías, en la gestión de costos y en la resolución de incidentes. Además, cuando los equipos rotan, la pista de “dueño” se vuelve aún más difusa, lo que obliga a los ingenieros a invertir tiempo en “arqueología” de Slack, documentos internos o correos. ...

June 13, 2026 · Ernesto

Cómo automatizar la gestión de listas de IP de proveedores cloud y bots en Nginx, iptables y UFW

Problema En entornos auto‑hosted es habitual exponer un reverse proxy (Nginx, Caddy, HAProxy, etc.) que recibe tráfico de todo internet. Los crawlers de IA, los bots de búsqueda y los rangos de IP de los proveedores cloud aparecen constantemente en los logs y pueden consumir recursos o generar falsos positivos en WAFs. Mantener listas manuales de “no permitir” o “permitir” es una tarea que se vuelve insostenible: los proveedores añaden o retiran bloques cada pocos días, y los CI/CD de terceros (CircleCI, TeamCity…) también usan rangos dinámicos. El síntoma típico es un aumento inesperado de errores 403/404, saturación de logs y, a veces, bloqueos de servicios legítimos porque la lista está desactualizada. ...

June 12, 2026 · Ernesto

Cómo migrar de CloudFormation/Ansible a Kubernetes y Terraform en producción

Problema Muchas empresas y profesionales han construido entornos productivos con CloudFormation y Ansible porque esas herramientas estaban maduras y bien soportadas cuando el proyecto arrancó. Con el tiempo, el mercado laboral y los estándares de la industria han evolucionado: Kubernetes se ha convertido en la plataforma de facto para orquestar contenedores y Terraform es la herramienta de infraestructura como código (IaC) más demandada. El reto surge cuando un ingeniero necesita demostrar que su experiencia con stacks “legacy” es transferible y, además, necesita migrar una infraestructura existente sin interrumpir el servicio. ...

June 12, 2026 · Ernesto

Cómo recuperar acceso a una cuenta root de AWS sin MFA ni número de teléfono

Problema Perder el dispositivo MFA y el número de teléfono asociado a la cuenta root de AWS deja al propietario sin una vía directa para autenticarse. Aunque el correo electrónico y la contraseña siguen vigentes, AWS exige MFA para cualquier acceso root. En entornos productivos —por ejemplo, dominios gestionados en Route 53 o infraestructuras críticas— la imposibilidad de iniciar sesión bloquea despliegues, renovaciones de certificados y cambios de facturación. El patrón típico es: ...

June 7, 2026 · Ernesto

Cómo cumplir requisitos de almacenamiento al restaurar desde Azure Backup Vault

Problema Al intentar restaurar una máquina virtual o un disco desde un Azure Backup Vault, el proceso falla porque Azure exige que el destino de la restauración sea una cuenta de almacenamiento ubicada en la misma región que el vault. Además, la documentación oficial menciona que Blob storage no está soportado, lo que deja a los administradores preguntándose qué tipo de cuenta usar y qué configuraciones son aceptables (LRS, ZRS, Standard vs Premium, etc.). El problema se manifiesta con mensajes de error que indican incompatibilidad de la cuenta de almacenamiento o ausencia de una cuenta válida en la región requerida. ...

June 6, 2026 · Ernesto

Cómo dimensionar Azure Document Intelligence Docker para hosting local de alto rendimiento

Problema Muchas organizaciones quieren ejecutar Azure Document Intelligence (ADI) dentro de un contenedor Docker sin conexión a Internet, ya sea por requisitos de seguridad o por latencia mínima. Microsoft publica requisitos mínimos (8 vCPU + 24 GB RAM), pero esos números no indican cuántas páginas por segundo se pueden procesar ni cuál es la configuración adecuada para volúmenes de 5 – 100 millones de documentos anuales. El reto típico es traducir una carga de trabajo (por ejemplo, 100 000 páginas en 24 h o 5 páginas / s de forma sostenida) en una especificación de hardware que garantice estabilidad y coste razonable. ...

June 5, 2026 · Ernesto

Cómo diseñar una hoja de ruta DevSecOps integral

Problema Los profesionales que aspiran a roles DevSecOps suelen encontrarse con un panorama fragmentado: conocimientos de Linux, scripting, cloud, IAM, bases de datos, contenedores y pipelines están dispersos en cursos aislados. La falta de una secuencia estructurada genera lagunas de habilidades, proyectos sin foco y certificaciones desconectadas del trabajo real. El síntoma típico es pasar de un tema a otro sin consolidar lo aprendido, lo que retrasa la transición a un puesto productivo. ...

June 5, 2026 · Ernesto

Cómo saber si enfocarse solo en on‑prem Kubernetes sin AWS/Azure perjudica tu carrera DevOps

Problema Muchos ingenieros junior dedican su tiempo a montar clústers de Kubernetes en servidores propios, usando herramientas como K3s, Cilium, ArgoCD o Longhorn. La inquietud surge cuando el mercado laboral pide experiencia en los grandes proveedores de nube (AWS, Azure, GCP). La pregunta central es si una carrera centrada exclusivamente en infraestructura on‑prem puede quedar rezagada frente a perfiles que manejan servicios gestionados en la nube, y cómo equilibrar ambos mundos sin perder profundidad técnica. ...

June 5, 2026 · Ernesto

Cómo solucionar fallos intermitentes de Azure Functions al subir archivos >30 MB

Problema En entornos de producción es frecuente que una Azure Function expuesta vía HTTP reciba archivos desde un cliente web. Cuando el tamaño del payload supera los 30 MB, los desarrolladores observan respuestas intermitentes: a veces la carga finaliza con éxito, otras veces la petición termina con error 500 o 408. El comportamiento es aleatorio, no depende del cliente ni del tipo de archivo, y ocurre solo en producción; en local la función acepta archivos de 100 MB sin inconvenientes. Este patrón indica que algo en la cadena de ejecución (plano de Azure Functions, red, autenticación o Blob Storage) está imponiendo restricciones que no se reflejan en el entorno de desarrollo. ...

June 4, 2026 · Ernesto

Cómo lograr trazabilidad de errores end‑to‑end en Azure Functions y servicios asociados

Problema En arquitecturas compuestas por Azure Functions, Cosmos DB, Service Bus, LLMs y callbacks externos, la visibilidad de una solicitud completa suele fragmentarse. Cada componente escribe en su propio espacio de logging y, aunque todos comparten un identificador de ejecución (por ejemplo execution_id), los ingenieros deben abrir varios recursos de Application Insights, buscar en tablas de Log Analytics y correlacionar manualmente los eventos. El resultado es: tiempos de diagnóstico de 20‑40 minutos, ejecuciones que quedan “atascadas” en el Change Feed o en colas, fallos de callbacks que no se detectan hasta que el cliente reclama, falta de contexto para determinar si el problema es global, por tenant o por tipo de petición. Este patrón se repite en cualquier pipeline serverless donde varios servicios Azure interactúan y donde la latencia de los componentes externos (LLM, APIs de terceros) es variable. ...

June 3, 2026 · Ernesto