Gray failures: cuando nada está «caído» pero todo va mal

Un pod con 8 GB de heap Java lleva tres días subiendo su consumo de memoria un par de puntos porcentuales cada hora. El liveness probe lo comprueba cada diez segundos y siempre recibe la misma respuesta: 200, cuarenta milisegundos. Ese proceso está, a todos los efectos que mide Kubernetes, perfectamente sano. Pero cuando ese … Leer más

¿Quién monitoriza al Collector? Telemetría interna del OpenTelemetry Collector

El OpenTelemetry Collector es el componente sobre el que descansa todo tu pipeline de telemetría. Recibe trazas de tus aplicaciones, las procesa, las enruta y las envía a los backends. Es la pieza que conecta la instrumentación con la observabilidad. Y hay un 23% de equipos que lo tienen en producción sin monitorizarlo en absoluto. … Leer más

Novedades Observabilidad: semana del 07/06/2026 al 14/06/2026

Resumen semanal del ecosistema cloud-native y SRE: OpenTelemetry, CNCF y SRE Weekly. Artículos y contenidos originales en inglés resumidos en español para facilitar el seguimiento de novedades, releases y tendencias del sector sin depender de ningún vendor concreto. CNCF Blog Securing CI/CD for an open source project: Locking down dependencies Publicado el 2026-06-12 — Leer … Leer más

Continuous profiling en la práctica: Parca, Pyroscope y el agente eBPF de OpenTelemetry

Un servicio de checkout en Go que llevaba meses estable empieza a arrastrar la latencia tras el despliegue del martes. El p99 sube de 120 ms a 400 ms, pero nada cuadra: la CPU del pod está al 40 %, la memoria plana, los logs limpios y las trazas señalan que el tiempo se va … Leer más