StackPractices

Etiqueta: monitoring

Explora 28 recursos prácticos de ingeniería de software etiquetados con "monitoring". Descubre recetas de código, patrones de diseño, plantillas de documentación y guías detalladas para ayudarte a construir, desplegar y mantener soluciones listas para producción con monitoring.

Monitoreo y Alertas

El monitoreo es la practica de recolectar metricas, logs y trazas para comprender la salud del sistema. Una buena alerta te dice cuando algo esta mal sin inundarte de ruido.

Los recursos de esta coleccion cubren recoleccion de metricas, dashboards, SLOs, presupuestos de error, umbrales de alerta y flujos de on-call. Cada guia se enfoca en construir observabilidad rica en senales y pobre en ruido para servicios de produccion.

Cada recurso incluye explicaciones claras, ejemplos de codigo y advertencias sobre errores comunes. Usa estos materiales para tomar decisiones informadas, evitar problemas en produccion y acelerar tu flujo de trabajo. Si estas empezando, lee primero los articulos marcados como principiante; si ya tienes experiencia, ve directo a los patrones avanzados y las guias de arquitectura.

Monitorear Uso de Disco con Bash

Alerta cuando el espacio en disco cruza umbrales con scripts bash.

Configuración de Docker Health Check para Confiabilidad

Añade health checks proper a contenedores Docker con HEALTHCHECK

Dashboards de Grafana para Observabilidad con Prometheus

Construye dashboards de Grafana que visualizan métricas de Prometheus. Usá paneles, variables de...

Métricas y Alertas con Prometheus

Instrumenta aplicaciones e infraestructura con métricas de Prometheus, configura reglas de alertas...

Expón métricas de aplicación con Python y Prometheus

Construye un exporter de métricas Prometheus en Python con prometheus_client. Cubre counters,...

Monitorear Uso de Disco

Alerta cuando el espacio en disco cruza umbrales usando un script de Bash que verifica mount points...

Tracing Distribuido

Tracea requests a través de microservicios distribuidos con OpenTelemetry, Jaeger y Zipkin para...

Agregación de Logs

Centraliza logs de servicios distribuidos con ELK, Fluentd y Loki para búsqueda, alertado y...

Recoleccion de metricas

Recolecta, agrega y expone métricas de aplicación e infraestructura con Prometheus, StatsD y...

Monitoreo de APIs con Prometheus

Monitorea rendimiento y salud de APIs con métricas Prometheus, collectors personalizados y reglas...

Monitoreo de Usuarios Reales (RUM)

Monitorea experiencias reales de usuarios con Core Web Vitals, session replay y análisis de...

Logging Estructurado

Implementa logging estructurado con salida JSON, correlation IDs y agregación de logs para...

Patron de Monitoreo de Endpoints de Salud

Expone endpoints de salud ligeros para que orquestadores, balanceadores de carga y herramientas de...

Plantilla de Monitoreo y Alertas de API

Una plantilla para definir umbrales de SLA, alertas de tasa de error y dashboards de monitoreo para...

Documento de Estandares de Logging

Una plantilla de documento para definir convenciones de logging estructurado, niveles de log,...

Plantilla de Politica de Monitoreo y Alertas

Una plantilla de politica que define como se configuran, enrutan, escalan y revisan las alertas en...

Plantilla de Production Readiness Review

Una checklist essential para verificar que un servicio, feature, o sistema esta listo para...

Plantilla de Objetivo de Nivel de Servicio (SLO)

Una plantilla para definir objetivos de confiabilidad, presupuestos de error y metodos de medicion...

Plantilla de Diseño de Dashboards

Una plantilla para diseñar dashboards de observabilidad con SLOs, error budgets, service health e...

Plantilla de Performance Budget

Plantilla para definir y enforcear web performance budgets: LCP, INP, CLS targets, resource budgets...