Skip to content
StackPractices

Etiqueta: devops

Explora 117 recursos prácticos de ingeniería de software etiquetados con "devops". Descubre recetas de código, patrones de diseño, plantillas de documentación y guías detalladas para ayudarte a construir, desplegar y mantener soluciones listas para producción con devops.

Analizar Archivos de Log

Cómo analizar archivos de log de servidores usando Python, Java y JavaScript.

Evolución de Schema de Base de Datos

Evoluciona schemas de base de datos de forma segura con cambios backward-compatible, migraciones versionadas y operaciones DDL online en ambientes de producción.

Playbook de Ansible para Configuración de Servidores

Cómo escribir y ejecutar playbooks de Ansible para provisionar, configurar y gestionar servidores con tareas idempotentes, roles y archivos de inventario.

Desplegar Contenedores en AWS ECS con Fargate

Como desplegar contenedores Docker en AWS ECS usando computacion serverless Fargate con Terraform y GitHub Actions

Tareas en Segundo Plano (Background Jobs)

Cómo programar y ejecutar tareas en segundo plano usando cron, colas de trabajo y workers.

Script de Rotación de Backups en Bash

Backups automatizados con políticas de retención usando bash y find.

Scripting en Bash para Automatizacion DevOps y Tareas de

Como escribir scripts Bash robustos para automatizar despliegues, monitoreo de sistemas, rotacion de logs y tareas de mantenimiento rutinarias

Despliegue Blue-Green

Despliega con zero downtime usando ambientes blue-green, conmutación instantánea de tráfico y capacidades de rollback automatizado.

Chaos Engineering

Construye sistemas resilientes inyectando fallas intencionalmente y observando cómo responden y se recuperan tus servicios distribuidos.

Configuración de Pipelines CI/CD

Configura pipelines CI/CD automatizados para testing, building y deployment de aplicaciones con GitHub Actions y lo que funciona.

Herramienta CLI con Parseo de Argumentos

Cómo construir una interfaz de línea de comandos profesional con parseo de argumentos, flags y subcomandos.

Escaneo de Seguridad de Imagenes de Contenedores con Trivy

Escanea imagenes Docker para vulnerabilidades, configuraciones incorrectas y secretos usando Trivy, integra el escaneo en pipelines de CI/CD y aplica politicas de imagen antes del deployment a produccion

Cron Jobs

Cómo programar y gestionar tareas recurrentes usando sintaxis cron en Linux, Python y Node.js.

Fundamentos de Docker

Cómo containerizar una aplicación, escribir un Dockerfile y ejecutar contenedores con Docker Compose.

Docker Compose Dev/Prod: Separación de Entornos

Separa configs de Docker Compose para desarrollo y producción con overrides

Desarrollo Local de Microservicios con Docker Compose

Orquesta entornos locales multi-servicio con Docker Compose incluyendo bases de datos, caches, message brokers y reverse proxies con hot reload y redes compartidas

Override Configs de Docker Compose por Entorno

Cómo usar Docker Compose override files para configuraciones específicas por entorno, cubriendo dev, test, staging, production, profiles y secrets management.

Imágenes de Producción Slim con Multi-Stage Docker

Cómo construir imágenes Docker de producción minimales usando multi-stage builds con distroless base images, cubriendo Go, Node.js, Python y Java con reducción de tamaño.

Variables de Entorno

Cómo leer, establecer y gestionar variables de entorno de forma segura en Python, JavaScript y Java.

Feature Flags (Banderas de Funcionalidad)

Cómo implementar feature toggles para desplegar, probar y revertir funcionalidad de forma segura sin desplegar código.

Generar Sitemaps en Vivo

Cómo construir y servir sitemaps XML en vivo desde los datos de tu aplicación, con soporte multi-idioma, paginación y fechas lastmod automáticas.

Flujo de Trabajo Git

Una estrategia de branching práctica para equipos: ramas de feature, pull requests e historial limpio de commits.

Testear a Través de Múltiples OS y Versiones con GitHub

Cómo usar GitHub Actions matrix strategy para testear a través de múltiples sistemas operativos, versiones de lenguajes y configuraciones con include, exclude y matrices dinámicas.

Compartir Lógica de Workflows con GitHub Actions

Cómo crear y consumir reusable workflows en GitHub Actions, cubriendo inputs, secrets, jobs condicionales, matrix strategy y sharing a nivel organización.

GitHub Actions CI/CD

Cómo construir y desplegar con GitHub Actions usando workflows, matrices, caching y secrets.

Implementar graceful shutdown y reinicios sin downtime

Cómo implementar graceful shutdown y reinicios sin downtime para servidores web, workers y contenedores

Dashboards de Observabilidad con Grafana y Prometheus

Construye dashboards interactivos en Grafana que visualizan metricas Prometheus con paneles, variables y alerts para observabilidad completa de servicios

Endpoint de Health Check

Cómo implementar un endpoint de health check listo para producción para monitoreo y load balancers.

Despliegue de Aplicaciones en Kubernetes con Helm Charts

Empaqueta, versiona y despliega aplicaciones Kubernetes usando Helm charts con value overrides, funciones de template y release management para infraestructura reproducible

Infraestructura Inmutable

Construye infraestructura inmutable con imágenes de máquina versionadas y containers para eliminar configuration drift y asegurar despliegues reproducibles.

Despliegues Canary con Istio Service Mesh

Como usar el splitting de trafico de Istio para realizar despliegues canary seguros desplazando gradualmente usuarios entre versiones de aplicaciones

Montar Configs y Secrets en Pods de Kubernetes

Cómo montar ConfigMaps y Secrets en pods de Kubernetes usando env vars, volumes, projected volumes y secret management con external secrets.

Empaquetar Manifests de Kubernetes con Helm Charts

Cómo crear, templetar y desplegar aplicaciones de Kubernetes usando Helm charts, cubriendo values, conditionals, ranges, hooks, subcharts y library charts.

Analizar y Validar Configuración YAML/JSON

Cómo analizar y validar archivos de configuración de aplicaciones usando esquemas YAML y JSON.

Configurar pre-commit hooks

Cómo configurar pre-commit hooks con husky, lint-staged y pre-commit para forzar calidad de código antes de commits

Metricas y Alertas con Prometheus

Instrumenta aplicaciones e infraestructura con metricas Prometheus, configura reglas de alerting y recording rules para monitoreo eficiente de salud de servicios

Retry con Backoff Exponencial

Cómo implementar lógica de retry resiliente con backoff exponencial y jitter para fallos transitorios en llamadas de red y APIs.

Gestionar Secretos de Aplicaciones de Forma Segura

Cómo almacenar, rotar e inyectar API keys, contraseñas de base de datos y certificados sin hardcodearlos en código fuente o archivos de entorno.

Configurar CI con GitLab Pipelines

Cómo configurar pipelines de GitLab CI/CD para testing, building y deployment usando .gitlab-ci.yml con stages, jobs, caching y runners.

Configurar Certificados SSL con Let's Encrypt

Cómo obtener, instalar y renovar automáticamente certificados SSL usando Certbot con Nginx, Apache y modos standalone para despliegues con HTTPS.

Provisiona una VPC de AWS con Terraform

Como usar Terraform para provisionar una VPC de AWS lista para produccion con subredes publicas y privadas, NAT gateways y security groups

Almacenar Terraform State en S3 con DynamoDB Locking

Cómo configurar Terraform remote state con S3 backend y DynamoDB locking, cubriendo state isolation, workspace management, encryption e integración con CI/CD.

Aislar Entornos con Terraform Workspaces

Cómo usar Terraform workspaces para environment isolation, cubriendo workspace creation, conditional resources, variable management y migración a separate state files.

Traffic Mirroring

Replica tráfico de producción a ambientes de staging para testing realista, despliegues shadow y validación de performance sin impactar usuarios.

Optimización de Costos Cloud

Reduce costos de infraestructura cloud con right-sizing, instancias reservadas, spot instances y scheduling automatizado en AWS, GCP y Azure.

Task Queues y RPC con RabbitMQ y AMQP

Implementa distribucion confiable de tareas y patrones request-reply usando RabbitMQ con durable queues, dead-letter exchanges y prefetch para concurrencia controlada

Agregación de Logs

Centraliza logs de servicios distribuidos con ELK, Fluentd y Loki para búsqueda, alertado y troubleshooting en producción.

Monitoreo de APIs con Prometheus

Monitorea rendimiento y salud de APIs con métricas Prometheus, collectors personalizados y reglas de alertamiento.

Logging Estructurado

Implementa logging estructurado con salida JSON, correlation IDs y agregación de logs para observabilidad en producción.

Escaneo de Seguridad de Containers

Escanea imágenes de container para vulnerabilidades, misconfiguraciones y secrets con Trivy, Clair y Snyk antes de desplegar a producción.

Patron de Almacen Externo de Configuracion

Centraliza la configuracion de aplicaciones fuera de los artefactos de despliegue para soportar actualizaciones en vivo y gestion multi-entorno.

Plantilla de Política de Auto-Scaling

Una plantilla para documentar reglas de scale-up y scale-down para infraestructura en la nube.

Plantilla de Verificación de Backup y Restore

Una plantilla para documentar procedimientos de verificación de backups de bases de datos y archivos.

Plantilla de Triaje de Bugs

Plantilla para clasificar y enrutar reportes de bugs por severidad e impacto.

Plantilla de Gestión de Cambios

Plantilla para documentar revisiones CAB y criterios de reversión para cambios en producción.

Plantilla de Diseño de Pipeline CI/CD

Una plantilla para documentar stages, gates, environments, deployment strategies, rollback procedures y security scanning de pipelines CI/CD.

Plantilla de Asignación de Costos en la Nube

Una plantilla para rastrear y asignar costos de nube por equipo y entorno.

Plantilla de Prueba de Failover Cross-Region

Una plantilla para documentar procedimientos de prueba de disaster recovery multi-región.

Runbook para Actualización de Dependencias

Un runbook paso a paso para actualizar las dependencias del proyecto de forma segura.

Plantilla de Checklist de Despliegue

Una checklist de verificación pre-release para despliegues seguros en producción.

Runbook de Rollback de Despliegues

Runbook para revertir despliegues fallidos de forma segura: rollback triggers, Kubernetes rollback, blue-green deployment rollback, canary rollback, database migration rollback, verification steps y post-rollback procedures con ejemplos de codigo para kubectl, Helm y ArgoCD.

Checklist de Hardening de Docker Images

Checklist para hardening de Docker container images para production: base image selection, user permissions, filesystem restrictions, network isolation, resource limits, secret management, vulnerability scanning y CI/CD integration con Dockerfile examples.

Plantilla de Comunicación de Tiempo de Inactividad

Plantilla para mensajes internos y externos durante interrupciones del servicio.

Plantilla de Política de Escalamiento

Una plantilla para definir niveles de severidad de incidentes y rutas de escalamiento de guardia.

Checklist de Revisión de Helm Charts

Un checklist para revisar Helm charts cubriendo values, templates, security, resource limits, probes, RBAC y best practices.

Plantilla de Revisión de Infrastructure as Code

Una plantilla para revisar código de infraestructura Terraform y CloudFormation.

Plantilla de Pod Disruption Budget de Kubernetes

Una plantilla para definir Pod Disruption Budgets que controlan voluntary disruptions durante node drains, upgrades y maintenance windows.

Plantilla de Kubernetes Resource Quotas

Plantilla para definir Kubernetes resource quotas por namespace: CPU y memory limits, object count quotas, storage quotas, LimitRanges para default requests, priority class integration y monitoring con ejemplos para multi-tenant clusters.

Plantilla de Seguridad de Red

Una plantilla para documentar el inventario de reglas de seguridad de VPC, firewall y DNS.

Plantilla de Runbook de Guardia

Una plantilla que documenta alertas comunes y procedimientos de respuesta paso a paso para ingenieros de guardia.

Plantilla de Gestión de Parches

Una plantilla para programar, probar y desplegar parches de seguridad en todos los entornos.

Plantilla de Regresión de Rendimiento

Una plantilla para comparar benchmarks y crear planes de acción cuando el rendimiento se degrada.

Plantilla de Comunicación de Despliegues

Una plantilla para notas de release y actualizaciones de stakeholders durante despliegues de capacidades.

Plantilla de Objetivos de Nivel de Servicio

Plantilla para definir SLOs, SLIs y presupuestos de error para la gestión confiable de servicios.

Plantilla de Renovación de Certificados SSL

Plantilla para rastrear la caducidad de certificados SSL y los flujos de trabajo de renovación.

Politica de Versioning de Terraform Modules

Politica para versioning y publishing de Terraform modules: semantic versioning rules, breaking change management, module registry publishing, changelog requirements, deprecation process y CI/CD integration con ejemplos para Terraform Cloud y private registries.

Política de Gestión de Estado de Terraform

Una política para gestionar Terraform state files: backend configuration, locking, isolation, access control, versioning y disaster recovery.

Plantilla de Revisión Semanal de Operaciones

Plantilla para resumir incidentes, costos, rendimiento y acciones en revisiones semanales de operaciones.

Plantilla de Página de Estado de API

Una plantilla para una página de estado de API pública que comunica uptime, incidentes y ventanas de mantenimiento a los consumidores.

Plantilla de Reporte de Bug

Plantilla estructurada de reporte de bugs para ayudar a equipos a reproducir, clasificar y resolver defectos más rápido con pasos claros y comportamiento esperado.

Plantilla de Planificación de Capacidad

Una plantilla reutilizable para planificar capacidad del sistema, estimar crecimiento y prevenir cuellos de botella de rendimiento antes de que ocurran.

Plantilla de Changelog

Plantilla de changelog estructurada siguiendo las convenciones de Keep a Changelog para registrar versiones del proyecto.

Plantilla de Código de Conducta

Plantilla de código de conducta comunitaria para establecer estándares de colaboración inclusivos y respetuosos.

Plantilla de Guía de Contribución

Una plantilla lista para usar con directrices de contribución para proyectos open-source e internos.

Plantilla de Plan de Recuperación ante Desastres

Plantilla de plan de recuperación ante desastres para documentar targets RTO/RPO, procedimientos de failover y runbooks de recuperación que minimizan downtime ante fallas catastróficas.

Plantilla de Guía de Configuración de Entorno

Plantilla para documentar cómo configurar ambientes de desarrollo local, staging y producción de forma consistente y reproducible.

Plantilla de Solicitud de Feature

Plantilla estructurada de solicitud de capacidades para ayudar equipos a evaluar, priorizar e implementar nuevas capacidades con valor de usuario claro y criterios de aceptación.

Plantilla de Guía de Onboarding

Plantilla de guía de onboarding completa para ayudar a nuevos miembros del equipo a ser productivos rápidamente.

Plantilla de Checklist Post-Deploy

Plantilla de checklist para verificar deployments: health checks, smoke tests, validación de métricas y rollback readiness antes de declarar all-clear.

Plantilla de Pull Request

Plantilla de pull request completa para estandarizar code reviews y mejorar la calidad de merges.

Plantilla README

Una plantilla README lista para producción para proyectos open-source e internos.

Plantilla de Release Notes

Plantilla de release notes que comunica cambios claramente a usuarios, operadores y stakeholders con categorías, instrucciones de upgrade e issues conocidos.

Plantilla de Runbook

Una plantilla reutilizable para runbooks operacionales: respuesta a incidentes, procedimientos de deployment y tareas rutinarias.

Plantilla de Documento SLO (Service Level Objective)

Plantilla de documento SLO que define targets de confiabilidad, presupuestos de error y políticas de escalación para servicios y plataformas.

Arquitectura Orientada a Eventos — Colas, Tópicos y Streams

Guía práctica de arquitectura orientada a eventos: eventos vs comandos, brokers de mensajes, patrones como CQRS y Saga, y cuándo elegir async sobre sync.

De Monolito a Microservicios — Estrategias de Migración

Guía práctica para descomponer monolitos: strangler fig, branch by abstraction y patrones de extracción incremental que reducen riesgo y preservan continuidad del negocio.

Lo que Funciona en Code Review — Para Autores y Revisores

Una guía práctica para revisiones de código útiles: cómo escribir código revisable, dar feedback constructivo y mantener las revisiones rápidas y enfocadas.

Guía de Pipelines CI/CD

Una guía práctica para construir pipelines CI/CD con GitHub Actions, testing, estrategias de deployment y procedimientos de rollback.

Referencia Detallada de CI/CD con GitHub Actions

Construye pipelines CI/CD desde cero con GitHub Actions. Cubre workflows, runners, matrix builds, caching, secrets, environments, deployment strategies y reusable workflows.

Referencia Detallada de Docker en Producción

Ejecutar contenedores Docker en produccion con confianza. Cubre multi-stage builds, imagenes distroless, health checks, image scanning, resource limits, logging, secrets, multi-arch builds y seguridad del container runtime con ejemplos practicos de Dockerfiles.

Referencia Detallada de GitOps con ArgoCD

Despliega aplicaciones Kubernetes con GitOps usando ArgoCD. Cubre instalación, ApplicationSets, estrategias de sync, Helm/Kustomize, RBAC y multi-cluster.

Referencia Detallada de GitOps en Producción

Implementar GitOps con ArgoCD y Flux. Cubre declarative infrastructure, drift reconciliation, automated rollbacks, progressive delivery, multi-cluster management, secret management con SOPS y CI/CD pipeline integration con ejemplos practicos de YAML.

Referencia Detallada de Kubernetes Networking

Kubernetes networking. Cubre Services, Ingress, NetworkPolicies, CNI plugins, DNS, service mesh, load balancing, external traffic, mTLS y troubleshooting con ejemplos practicos de YAML manifests y configuracion.

Referencia Detallada de Monitoring y Alerting

Construir un production monitoring stack. Cubre Prometheus, Grafana, AlertManager, metrics instrumentation, alert rules, runbooks, SLI/SLO/SLA, distributed tracing con Jaeger, log aggregation y on-call best practices con ejemplos practicos de configuracion.

Referencia Detallada de Módulos de Terraform

Construye módulos de Terraform reutilizables con estructura adecuada, inputs, outputs y versionado. Cubre composición, testing y publicación en el Registry.

Referencia Detallada de Terraform en Producción

Gestionar infrastructure as code con Terraform en produccion. Cubre modules, state management, workspaces, drift detection, remote backends, variable validation, sentinel policies y CI/CD integration con ejemplos practicos de HCL.

Despliegues Blue-Green y Canary

Guía práctica de estrategias de deploy: blue-green, canary, rolling y feature flags. Minimiza riesgo y tiempo de rollback al liberar a producción.

Docker para Desarrolladores — Referencia Detallada

Aprende Docker desde cero: imágenes, contenedores, Dockerfiles, redes, volúmenes y Docker Compose para desarrollo local.

Estrategias de Branching en Git: Guía Práctica

Compara trunk-based development, GitFlow y GitHub Flow. Elige la estrategia de branching correcta según el tamaño de tu equipo, cadencia de releases y madurez de CI/CD.

Infrastructure as Code — Terraform y Pulumi

Guía práctica para gestionar infraestructura como código: beneficios de enfoques declarativo vs imperativo, manejo de estado, módulos y testing de cambios de infraestructura.

Kubernetes Básico para Desarrolladores de Aplicaciones

Aprende los conceptos core de Kubernetes que todo desarrollador necesita: Pods, Services, Deployments, ConfigMaps y comandos básicos de kubectl.

Guía de Logging, Monitoreo y Observabilidad

Guía para construir sistemas observables con logging estructurado, métricas y tracing distribuido.

Monitoreo y Alertas — Métricas, Logs y Dashboards

Guía práctica de observabilidad: los tres pilares (métricas, logs, traces), métodos RED y USE, diseño de alertas, y dashboards que realmente ayudan.

Playbook de Guardias e Incidentes (On-Call)

Playbook práctico para ingenieros on-call: triage, escalamiento, comunicación y postmortems. Reduce el MTTR y construye una cultura de respuesta a incidentes resiliente.

Estrategia de Documentación Técnica: Docs as Code

Guía práctica para tratar la documentación como código: versionado, flujos de review, estructura y herramientas que mantienen los docs precisos, descubribles y mantenibles.

Guía de Optimización de Performance Web

manual detallado para optimizar el rendimiento de aplicaciones web con mejores Core Web Vitals y experiencia de usuario.