Automatización4 min de lectura

Cómo someter a estrés un flujo de automatización antes de activarlo

Una tarea rota falla una vez y te avisa de inmediato. Una automatización rota funciona en silencio y falla repetidamente, a menudo durante semanas. Así es como detectar los fallos antes de que se acumulen.

Por qué los fallos de automatización salen caros

Una tarea rota falla una vez y te avisa de inmediato. Una automatización rota funciona en silencio y falla repetidamente, a menudo durante semanas antes de que alguien se dé cuenta. La asimetría es brutal: los fallos de automatización se acumulan, mientras que las señales de que algo va mal suelen ser sutiles.

Primero, mapea los supuestos

Todo flujo de automatización se construye sobre supuestos: que los datos de entrada llegarán en el formato esperado, que la API responderá dentro del tiempo límite, que el sistema posterior aceptará la carga. Antes de someterlo a cualquier prueba de estrés, enumera estos supuestos de forma explícita. La mayoría de los fallos de automatización se remontan a un supuesto que nunca se puso por escrito.

Los tres modos de fallo que hay que probar

Pon a prueba tres categorías de fallo: (1) entradas límite, ¿qué pasa cuando los datos están mal formados, vacíos o fuera del rango esperado? (2) fallo de dependencia, ¿qué pasa cuando una API posterior no está disponible? (3) estrés de volumen, ¿qué pasa cuando el flujo recibe 10 veces la carga esperada?

La mayoría de los equipos prueban el camino ideal con todo detalle y casi no prueban los caminos de fallo. Invierte esa proporción en los flujos críticos para producción.

Haz un pre-mortem de la automatización

Imagina que la automatización lleva 3 meses funcionando y ha causado un problema grave. ¿Qué hizo? Trabaja hacia atrás desde ese fallo para identificar qué supuesto se rompió, qué prueba no ejecutaste y qué alerta no configuraste. Este fallo imaginado suele revelar uno o dos casos límite críticos que la batería de pruebas estándar pasa por alto.

Antes de pasar a producción

Tres cosas antes de activar cualquier automatización con consecuencias reales: una lista escrita de lo que estás asumiendo, un plan de reversión que no dependa de que la automatización funcione, y una alerta de monitoreo que se dispare ante un volumen de salida o una tasa de error anómalos. Ninguna de las tres toma más de una hora. Las tres han evitado incidentes en producción que habrían tardado semanas en resolverse.

Share