Monitorización
Vigilamos la plataforma de forma continua para detectar problemas, idealmente
antes de que te afecten.
Qué vigilamos
- Disponibilidad: que tu aplicación responde correctamente.
- Rendimiento: tiempos de respuesta y uso de recursos.
- Salud de los componentes: estado de cada pieza del servicio.
- Capacidad: uso de cómputo, memoria y almacenamiento, para anticipar
necesidades.
- Señales de seguridad: comportamientos anómalos.
Cómo lo hacemos
La plataforma cuenta con un sistema de monitorización y observabilidad que
recoge métricas y registros de operación, y con alertas automáticas que avisan
a nuestro equipo cuando un indicador se sale de lo esperado.
Cómo determinamos el estado de tu servicio
Sondeamos tu servicio de forma continua desde fuera (aproximadamente cada 30 segundos) y
clasificamos su estado en tres niveles:
| Estado |
Qué significa |
| 🟢 Operativo |
Responde correctamente y con un tiempo de respuesta normal. |
| 🟠 Rendimiento degradado |
Sigue funcionando, pero más lento de lo habitual (o de forma intermitente). |
| 🔴 Caída |
No responde o devuelve un error. |
Cómo medimos el rendimiento degradado
No aplicamos un número fijo igual para todos: comparamos cada servicio con su propio
comportamiento normal (su tiempo de respuesta habitual, calculado sobre los últimos días).
Consideramos que hay rendimiento degradado cuando, de forma sostenida:
- el tiempo de respuesta se mantiene por encima de unas 3 veces su valor habitual, o
- supera un umbral absoluto de seguridad (del orden de 2 segundos), aunque ese servicio
suela ser lento, o
- el servicio falla de forma intermitente (unos sondeos responden y otros no).
…y siempre que la situación se mantenga durante al menos 5 minutos. Así evitamos avisos por
un pico puntual: un microcorte de red o una consulta lenta aislada no cuentan como
degradación.
Cómo detectamos una caída
Una caída se detecta de inmediato: en cuanto un sondeo no obtiene una respuesta correcta,
el servicio pasa a 🔴 y se genera el aviso a nuestro equipo sin esperar.
Disponibilidad (SLA)
Además del estado actual, mostramos el porcentaje de disponibilidad en distintos periodos
(1, 7 y 30 días): el porcentaje de tiempo en que el servicio respondió correctamente. Un
servicio lento pero funcionando cuenta como disponible — la lentitud afecta al estado de
rendimiento, no al porcentaje de disponibilidad.
Transparencia
Puedes consultar el estado en tiempo real en
status.dyncloud.es. El estado
detallado de los entornos de cliente requiere acceso autenticado.
Registros de operación
Conservamos registros de operación de la plataforma que nos permiten diagnosticar
incidentes y entender qué ocurrió. Estos registros se gestionan conforme a
nuestras políticas de seguridad y protección de datos.
Proactividad
El objetivo de la monitorización no es solo reaccionar, sino anticipar:
detectar una tendencia (por ejemplo, un crecimiento de capacidad) y actuar
antes de que se convierta en un problema para ti.