El fichero que dobló su tamaño: por qué la configuración tumba más servicios que el código

El 18 de noviembre de 2025, a las 11:05 UTC, Cloudflare desplegó un cambio de permisos en un clúster de ClickHouse, la base de datos columnar que usa para analítica. Nada exótico: hacer explícito que ciertos usuarios podían ver las tablas subyacentes de una base de datos llamada r0. Una consulta que llevaba tiempo funcionando, … Leer más

Kubernetes ya es un estándar. Monitorizarlo bien todavía no lo es

El 21 de mayo de 2026, en la Observability Summit de Minneapolis, la Cloud Native Computing Foundation anunció que OpenTelemetry se convertía en su segundo proyecto graduado con mayor velocidad de crecimiento de toda la fundación, solo por detrás de Kubernetes: más de 12.000 colaboradores, más de 2.800 empresas participando, y unas cifras de descarga … Leer más

SRE en 2026: vigilar modelos de IA sin dejar de vigilar el disco duro

En febrero de 2026, la compañía NeuBird AI publicó los resultados de una encuesta a 1.039 profesionales de SRE, DevOps y operaciones IT en empresas de más de 100 empleados. Los números, recogidos después en medios como Carrier Management, son incómodos de leer si te dedicas a esto: el 78% de los encuestados había sufrido … Leer más

Debajo de cada traza distribuida sigue habiendo un disco que se puede llenar

El 29 de junio de 2020, a las 00:28 UTC, la aplicación de gestión de clientes de GitLab (customers.gitlab.com) empezó a devolver errores 500. GitLab, que desde hace años lleva su gestión de incidentes en público —cualquiera puede leer hoy el issue original en su plataforma—, documentó la causa con la misma franqueza con la … Leer más