Observabilidad
Artículos etiquetados Observabilidad: notas y análisis agrupados por este tema.
-
Argo Rollouts: canary y blue-green con auto-rollback por métricas
Un RollingUpdate estándar declara el éxito cuando los pods pasan la readiness probe. Argo Rollouts convierte el release en una hipótesis verificable: canary por pasos, blue-green con preview, AnalysisTemplates con PromQL y el burn rate del SLO como rollback automático.
-
Observability 2.0: eBPF, OpenTelemetry e IA que encuentra la causa raíz
La instrumentación bajó al kernel, la telemetría al estándar OTel y la causa raíz migra hacia la máquina. Tres desplazamientos y el orden en que se amortizan.
-
OOMKilled: análisis forense de pmap a cgroups memory.stat
El exit code 137 no deja ni stack trace ni última línea de log, mientras el dashboard jura que la memoria sobraba. Las herramientas que responden «adónde se fue la memoria» — mientras el pod sigue vivo.
-
Cuatro señales doradas: qué capturan de verdad y por qué el stack es VictoriaMetrics + Loki
Qué captura cada una de las cuatro señales y tres trampas donde «tenemos monitoring» acaba siendo marcas verdes sobre un servicio roto.
-
Error budget como botón de parada: SLO sin pánico
El error budget convierte la fiabilidad en un recurso que puedes gastar — y las alertas multi-burn-rate en un aviso que de verdad merece despertarte.
-
Un agente de depuración de Kubernetes: ¿plantillas o scripts?
Zinchenko entrega al LLM plantillas de MetricsQL; mi skill de VM alimenta al agente con un agregado terminado. Disecciono el eje flexibilidad frente a reproducibilidad y por qué read-only por lista negra es más débil.