Todas las guías

Filtra por categoría, dificultad o texto libre para encontrar el material que encaja con tu equipo.

Metrics~40 min

Monitorizar TCPRoute y UDPRoute de Gateway API sin disparar la cardinalidad

Creada: 23 de agosto de 2026 · Publicada: 23 de agosto de 2026

Una guía para crear dashboards y alertas Prometheus/Grafana sobre TCPRoute y UDPRoute: inventario, PromQL, metric relabeling, canary y validación de que el tráfico L4 no queda ciego ni caro.

LinuxDocker
Intermedio
Leer guía
Metrics~45 min

Evitar que el churn de targets y los gaps de scrape cieguen tus alertas de burn rate

Creada: 17 de agosto de 2026 · Publicada: 17 de agosto de 2026

Aprende a endurecer alertas SLO de burn rate frente a churn de pods, gaps de scrape, endpoints inestables y no-data en Prometheus, con PromQL, promtool y canaries medibles.

LinuxDocker
Avanzado
Leer guía
Metrics~40 min

Reducir ruido de kube-state-metrics CustomResourceState sin romper alertas

Creada: 13 de agosto de 2026 · Publicada: 13 de agosto de 2026

Guía práctica para limpiar cardinalidad de kube-state-metrics y CustomResourceState con allowlists, metricRelabelings, PromQL de impacto y gates de rollback.

LinuxDocker
Intermedio
Leer guía
Metrics~40 min

Desplegar histogramas nativos de Prometheus sin dejar ciegos tus SLOs

Creada: 11 de agosto de 2026 · Publicada: 11 de agosto de 2026

Aprende a activar histogramas nativos con doble publicación, PromQL de paridad, límites de cardinalidad y guardrails de remote_write para que p95, p99 y burn alerts sigan siendo fiables.

LinuxDocker
Avanzado
Leer guía
Metrics~35 min

Gestionar dashboards de golden signals como código sin confiar en paneles con drift

Creada: 5 de agosto de 2026 · Publicada: 5 de agosto de 2026

Convierte dashboards críticos en artefactos revisables: Terraform, pruebas promtool, consultas Prometheus acotadas y canary visual antes de producción.

Linux
Intermedio
Leer guía
Metrics~45 min

Controlar la cardinalidad de rutas HTTP en Prometheus antes de que las golden signals mientan

Creada: 1 de agosto de 2026 · Publicada: 1 de agosto de 2026

Aprende a detectar labels explosivas en métricas HTTP, normalizar rutas, proteger remote_write y validar paneles/alertas antes de publicar golden signals de APIs en Kubernetes.

Avanzado
Leer guía
Metrics~40 min

Golden signals para controller-runtime: detectar caché lenta antes de culpar al API server

Creada: 30 de julio de 2026 · Publicada: 30 de julio de 2026

Aprende a instrumentar y diagnosticar controladores Kubernetes con métricas de controller-runtime, workqueue, caché y cliente REST antes de tocar concurrencia o reiniciar pods a ciegas.

Linux
Avanzado
Leer guía
Reliability~35 min

Triaje de alertas SLO burn rate desde Prometheus hasta trazas sin inventar culpables

Creada: 30 de julio de 2026 · Publicada: 30 de julio de 2026

Aprende a diseñar alertas multi-window, validar salud de telemetría y pivotar de PromQL a trazas para investigar burn rate sin perseguir fantasmas.

Linux
Intermedio
Leer guía
Metrics~40 min

Limpiar ruido de kube-state-metrics antes de que tus dashboards deriven

Creada: 21 de julio de 2026 · Publicada: 21 de julio de 2026

Aprende a auditar cardinalidad de kube-state-metrics, diseñar allowlists seguras, validar paridad de alertas y desplegar cambios sin romper dashboards de Kubernetes.

Linux
Intermedio
Leer guía
Reliability~45 min

Diseñar alertas SLO de burn rate multi-ventana sin despertar a nadie por ruido

Creada: 11 de julio de 2026 · Publicada: 11 de julio de 2026

Aprende a definir SLIs, budget, PromQL y pruebas promtool para alertas de burn rate que detectan incidentes rápidos sin convertir cada pico corto en una guardia rota.

Linux
Intermedio
Leer guía
Metrics~40 min

Montar golden signals para APIs HTTP en Kubernetes sin disparar la cardinalidad

Creada: 7 de julio de 2026 · Publicada: 7 de julio de 2026

Define un contrato de labels, crea recording rules RED/USE, valida cardinalidad con promtool y despliega dashboards de APIs Kubernetes sin convertir cada ruta en una fábrica de series.

LinuxDocker
Intermedio
Leer guía
Metrics~35 min

Limpiar ruido de kube-state-metrics antes de que las métricas de dispositivos disparen la cardinalidad

Creada: 26 de junio de 2026 · Publicada: 26 de junio de 2026

Detecta qué métricas de kube-state-metrics inflan Prometheus, poda labels volátiles con allowlists y valida que alertas y dashboards sigan funcionando antes de desplegar el cambio.

Linux
Intermedio
Leer guía
Reliability~35 min

Diseñar alertas de burn rate con Kubernetes PSI antes de que la latencia despierte a nadie

Creada: 24 de junio de 2026 · Publicada: 24 de junio de 2026

Una guía práctica para convertir burn-rate alerts en señales accionables: SLO claro, ventanas múltiples, PSI como contexto, pruebas con promtool y despliegue gradual.

Linux
Intermedio
Leer guía
Metrics~35 min

Diagnosticar presión de WATCH/LIST en Kubernetes API antes de culpar a etcd

Creada: 23 de junio de 2026 · Publicada: 23 de junio de 2026

Una guía accionable para detectar presión de WATCH/LIST en Kubernetes API combinando métricas de API server, etcd, Prometheus y validaciones de clientes antes de que aparezcan timeouts.

Linux
Avanzado
Leer guía
Metrics~35 min

Usar métricas PSI de Kubernetes para detectar saturación real en APIs sin paginar por ruido

Creada: 12 de junio de 2026 · Publicada: 12 de junio de 2026

Guía práctica para añadir PSI a los dashboards de APIs en Kubernetes, correlacionar presión de CPU/memoria/IO con SLIs y diseñar alertas que paginen solo cuando hay impacto real.

Linux
Intermedio
Leer guía
Reliability~35 min

Diseñar alertas de burn rate SLO que paginen por impacto real, no por ruido

Creada: 11 de junio de 2026 · Publicada: 11 de junio de 2026

Aprende a definir un SLI útil, combinar ventanas multi-burn, controlar cardinalidad y validar que una alerta SLO despierta solo cuando hay impacto real.

Linux
Intermedio
Leer guía
Metrics~35 min

Limpiar ruido de kube-state-metrics antes de que tus dashboards y alertas mientan

Creada: 10 de junio de 2026 · Publicada: 10 de junio de 2026

kube-state-metrics puede convertir el estado de Kubernetes en una tormenta de series, labels y paneles que parecen precisos pero no ayudan. Esta guía muestra cómo medir el ruido, recortar labels inestables, mantener señales clave y validar Prometheus antes de tocar producción.

LinuxDocker
Intermedio
Leer guía
Metrics~40 min

Entender las métricas de memoria de Kubernetes sin disparar falsas alertas de OOM

Creada: 26 de abril de 2026 · Publicada: 26 de abril de 2026

Guía práctica para diagnosticar memoria de contenedores en Kubernetes con Prometheus y Grafana sin confundir usage, working set, RSS ni page cache recuperable.

LinuxDocker
Intermedio
Leer guía
Metrics~35 min

Montar golden signals útiles para APIs en Kubernetes sin disparar la cardinalidad de Prometheus

Creada: 26 de abril de 2026 · Publicada: 26 de abril de 2026

Una guía práctica para definir tráfico, latencia, errores y saturación en APIs sobre Kubernetes sin llenar Prometheus de series inútiles ni romper alertas.

LinuxDocker
Intermedio
Leer guía
Reliability~36 min

Diseñar alertas de burn rate que no despierten a nadie por gusto

Creada: 22 de abril de 2026 · Publicada: 22 de abril de 2026

Las releases recientes de Prometheus, OpenTelemetry Collector, Loki y Alloy dejan una lección bastante poco romántica: las alertas atadas a métricas crudas y labels frágiles se rompen o se vuelven ruidosas con facilidad. Esta guía muestra cómo aterrizar burn-rate alerts sobre recording rules estables, validarlas con promtool y desplegarlas sin convertir cada pico corto en una falsa urgencia.

LinuxDocker
Intermedio
Leer guía
Metrics~38 min

Limpiar ruido de kube-state-metrics para que tus dashboards vuelvan a decir algo

Creada: 20 de abril de 2026 · Publicada: 20 de abril de 2026

kube-state-metrics sigue siendo útil, pero en 2026 llega con más superficie, más métricas estables y cambios recientes como EndpointSlices por defecto. Si tus paneles se llenaron de series irrelevantes, joins frágiles o estados duplicados, esta guía te enseña a reducir ruido en la fuente, corregir consultas y validar que el recorte no rompe alertas ni troubleshooting.

LinuxDocker
Intermedio
Leer guía
Metrics~45 min

Golden signals prácticos para APIs en Kubernetes sin inflar el stack

Creada: 15 de abril de 2026 · Publicada: 15 de abril de 2026

Guía técnica para definir golden signals aplicables a APIs en Kubernetes: métricas Prometheus, consultas PromQL, paneles de Grafana, reglas de alerta y un flujo de troubleshooting para diagnosticar y validar mitigaciones sin añadir agentes innecesarios.

LinuxDocker
Intermedio
Leer guía
Dashboards~20 min

Grafana para unificar métricas, logs y trazas (multiplataforma)

Creada: 7 de abril de 2026 · Publicada: 7 de abril de 2026

Despliega Grafana, provisiona datasources y deja un espacio listo para explorar métricas, logs y correlación con trazas.

Docker
Intermedio
Leer guía