StackPractices

Etiqueta: resilience

Explora 24 recursos prácticos de ingeniería de software etiquetados con "resilience". Descubre recetas de código, patrones de diseño, plantillas de documentación y guías detalladas para ayudarte a construir, desplegar y mantener soluciones listas para producción con resilience.

Patrones de Resiliencia

La resiliencia es la capacidad de un sistema de recuperarse de fallas y seguir operando. Se construye con reintentos, circuit breakers, bulkheads, fallbacks y degradacion gradual en lugar de una tecnica unica.

Los patrones y recetas a continuacion cubren circuit breakers, timeouts, reintentos con backoff, bulkheads, load shedding y failover. Cada recurso muestra como limitar el radio de explosion y proteger a los usuarios de fallas en cascada.

Cada recurso incluye explicaciones claras, ejemplos de codigo y advertencias sobre errores comunes. Usa estos materiales para tomar decisiones informadas, evitar problemas en produccion y acelerar tu flujo de trabajo. Si estas empezando, lee primero los articulos marcados como principiante; si ya tienes experiencia, ve directo a los patrones avanzados y las guias de arquitectura.

Retry con Exponential Backoff

Implementa estrategias de retry resilientes con exponential backoff, jitter e integración de...

Ingenieria del caos

Construye sistemas resilientes inyectando fallas intencionalmente y observando cómo responden y se...

Colas de mensajes muertos (Dead Letter Queues)

Maneja mensajes fallidos gracefulmente con dead letter queues, políticas de retry y detección de...

Patrón LLM Fallback

Recurre a proveedores o modelos LLM alternativos cuando el primario falla. Maneja rate limits,...

Patrón Back-Pressure

Previene que sistemas upstream abrumen a consumidores downstream propagando señales de control de...

Patrón Circuit Breaker

Previene fallos en cascada deteniendo solicitudes a servicios que están fallando. Un patrón...

Patrón Compensating Transaction

Deshace los efectos de una transacción completada ejecutando una operación contraria, habilitando...

Patrón Graceful Degradation

Degradar funcionalidad en lugar de fallar cuando dependencias no estan disponibles. Servir...

Patrón Retry

Reintenta una operación que ha fallado con errores transitorios, usando estrategias configurables...

Patron de Programador-Agente-Supervisor

Coordina la programacion de trabajos resilientes separando la logica de programacion de los agentes...

Patrón Shed Load

Rechazar requests proactivamente bajo carga extrema para proteger el sistema. Descartar trafico...

Patrón Timeout

Previene que las operaciones se cuelguen indefinidamente imponiendo un tiempo máximo de ejecución....

Circuit Breaker con Monitoring

Cómo exponer circuit breaker state como métricas para observability. Cubre Prometheus integration,...

Patrón Bulkhead: Isolá Resources para Limitar Blast Radius

Cómo isolatar resources per service para limitar blast radius. Cubre thread pool isolation,...

Patrón Circuit Breaker Half-Open

Cómo testear service recovery con half-open circuit breaker state transitions. Cubre closed, open,...

Patrón Fallover: Switcheá a Standby en Primary Failure

Cómo swithear a un standby system en primary failure detection. Cubre active-passive,...

Patrón Graceful Shutdown

Cómo drenear in-flight requests antes de process exit. Cubre signal handling, health check removal,...

Patrón Token Bucket Rate Limiter

Cómo implementar token bucket rate limiting para API protection. Cubre bucket refill, burst...

Patrón Retry with Jitter

Cómo retryar failed operations con exponential backoff y random jitter. Cubre full jitter, equal...

Plantilla de Prueba de Verificacion de Backups

Una plantilla para planificar y documentar pruebas de verificacion de backups, asegurando que los...