Qué es la observabilidad
La observabilidad es la capacidad de inferir el estado interno de un sistema a partir de lo que emite: métricas, registros y trazas. Cuanto más observable es un sistema, más rápido se pasa de un síntoma a una causa, sin adivinar.
En operaciones IT, observabilidad no es un producto concreto ni un sinónimo de monitorización. Es un criterio de diseño: instrumentar para preguntar cosas que no se habían previsto cuando se montó el panel.
De dónde viene el término
El concepto nace en la teoría de control: un sistema es observable si su estado interno se puede reconstruir a partir de sus salidas. En software e infraestructura, esas salidas son telemetría. No sustituye a la monitorización clásica; la amplía cuando los sistemas son distribuidos, efímeros y difíciles de recorrer a mano.
Tres pilares
Métricas
Medidas agregadas en el tiempo: uso de CPU, saturación de un disco, latencia p95, tasa de errores. Son baratas de almacenar y buenas para detectar desviaciones. Solas, rara vez explican el porqué.
Registros
Eventos discretos, inmutables, con contexto. Un log bien formado dice qué proceso, en qué host, con qué correlación y qué resultado. Sirven para depurar y para auditoría. Mal gobernados, se convierten en ruido.
Trazas
El camino de una petición entre servicios, colas y bases de datos. Enlazan un síntoma en el frontend con un cuello de botella tres saltos más atrás. En infra clásica, el equivalente es seguir una transacción o un job a través de varios sistemas.
Observabilidad, monitorización y APM
La monitorización responde a preguntas conocidas: ¿el host responde? ¿el trigger está en problema? El APM muestrea el rendimiento de aplicaciones con paneles y umbrales. La observabilidad entra cuando hay que investigar una incógnita desconocida: correlacionar señales, ver dependencias y entender el “qué, dónde y por qué” de un incidente.
En la práctica conviven. Zabbix es excelente recogiendo métricas y eventos de infraestructura. Grafana es excelente mostrando series y uniendo fuentes. Ninguno, por sí solo, garantiza observabilidad: hace falta criterio sobre qué instrumentar, cómo correlacionar y qué ignorar.
Por qué importa en Zabbix y Grafana
Muchos entornos IT ya tienen Zabbix para hosts, SNMP, agentes y triggers, y Grafana para paneles. El hueco suele estar en la costura: un incidente en Grafana no explica el trigger de Zabbix; un mapa de hosts no explica una traza de aplicación. Obsernia nace para trabajar esa costura con herramientas propias, sin pretender reemplazar esas plataformas.
Qué no es
- No es un recubrimiento de marketing sobre “más dashboards”.
- No es afiliación con Zabbix ni Grafana Labs.