Observabilidad, taxonomías de fallos y feedback loops
Telemetría no es un veredicto: señales de producción se convierten en fallos reproducibles, eval cases y reparaciones que vuelven a pasar por el mismo gate antes de regresar a producción.
Los enlaces con ?t= abren el vídeo en un segundo concreto.
Resumen del vídeo
Las ideas que debes retener
01
Observabilidad y evaluación responden preguntas distintas
La observabilidad intenta reconstruir qué ocurrió en un sistema en ejecución.
02
Primero conserva una identidad reproducible del sistema
Un fallo que no puede vincularse a lo que realmente estaba desplegado es muy difícil de explicar.
03
Un trace útil preserva causalidad, no todos los bytes
Registrar más datos no es siempre registrar mejor evidencia.