Etiqueta: monitoring
Explora 28 recursos prácticos de ingeniería de software etiquetados con "monitoring". Descubre recetas de código, patrones de diseño, plantillas de documentación y guías detalladas para ayudarte a construir, desplegar y mantener soluciones listas para producción con monitoring.
Monitoreo y Alertas
El monitoreo es la practica de recolectar metricas, logs y trazas para comprender la salud del sistema. Una buena alerta te dice cuando algo esta mal sin inundarte de ruido.
Los recursos de esta coleccion cubren recoleccion de metricas, dashboards, SLOs, presupuestos de error, umbrales de alerta y flujos de on-call. Cada guia se enfoca en construir observabilidad rica en senales y pobre en ruido para servicios de produccion.
Cada recurso incluye explicaciones claras, ejemplos de codigo y advertencias sobre errores comunes. Usa estos materiales para tomar decisiones informadas, evitar problemas en produccion y acelerar tu flujo de trabajo. Si estas empezando, lee primero los articulos marcados como principiante; si ya tienes experiencia, ve directo a los patrones avanzados y las guias de arquitectura.
Configuración de Docker Health Check para Confiabilidad
Añade health checks proper a contenedores Docker con HEALTHCHECK
Dashboards de Grafana para Observabilidad con Prometheus
Construye dashboards de Grafana que visualizan métricas de Prometheus. Usá paneles, variables de...
Métricas y Alertas con Prometheus
Instrumenta aplicaciones e infraestructura con métricas de Prometheus, configura reglas de alertas...
Expón métricas de aplicación con Python y Prometheus
Construye un exporter de métricas Prometheus en Python con prometheus_client. Cubre counters,...
Monitorear Uso de Disco
Alerta cuando el espacio en disco cruza umbrales usando un script de Bash que verifica mount points...
Tracing Distribuido
Tracea requests a través de microservicios distribuidos con OpenTelemetry, Jaeger y Zipkin para...
Agregación de Logs
Centraliza logs de servicios distribuidos con ELK, Fluentd y Loki para búsqueda, alertado y...
Recoleccion de metricas
Recolecta, agrega y expone métricas de aplicación e infraestructura con Prometheus, StatsD y...
Monitoreo de APIs con Prometheus
Monitorea rendimiento y salud de APIs con métricas Prometheus, collectors personalizados y reglas...
Monitoreo de Usuarios Reales (RUM)
Monitorea experiencias reales de usuarios con Core Web Vitals, session replay y análisis de...
Logging Estructurado
Implementa logging estructurado con salida JSON, correlation IDs y agregación de logs para...
Patron de Monitoreo de Endpoints de Salud
Expone endpoints de salud ligeros para que orquestadores, balanceadores de carga y herramientas de...
Plantilla de Monitoreo y Alertas de API
Una plantilla para definir umbrales de SLA, alertas de tasa de error y dashboards de monitoreo para...
Documento de Estandares de Logging
Una plantilla de documento para definir convenciones de logging estructurado, niveles de log,...
Plantilla de Politica de Monitoreo y Alertas
Una plantilla de politica que define como se configuran, enrutan, escalan y revisan las alertas en...
Plantilla de Production Readiness Review
Una checklist essential para verificar que un servicio, feature, o sistema esta listo para...
Plantilla de Objetivo de Nivel de Servicio (SLO)
Una plantilla para definir objetivos de confiabilidad, presupuestos de error y metodos de medicion...
Plantilla de Diseño de Dashboards
Una plantilla para diseñar dashboards de observabilidad con SLOs, error budgets, service health e...
Plantilla de Performance Budget
Plantilla para definir y enforcear web performance budgets: LCP, INP, CLS targets, resource budgets...