Cómo monitorizar la infraestructura IT de tu empresa con Zabbix
Monitorizar la infraestructura IT significa supervisar en tiempo real servidores, red y aplicaciones para detectar fallos antes de que corten la operativa. Con Zabbix y Grafana, una PYME configura alertas automáticas que reducen el tiempo de respuesta ante incidencias de horas a minutos, evitando paradas no detectadas que acumulan costes de productividad y soporte difíciles de cuantificar hasta que ya han ocurrido.
Por qué la monitorización IT importa a las PYMEs
Cuando un servidor se satura o un switch empieza a perder paquetes, el efecto inmediato no es un aviso en pantalla: es silencio. Los usuarios notan lentitud. El responsable IT recibe llamadas. Cuando se identifica el origen del problema, ya han pasado entre 30 minutos y varias horas.
Según el Balance de Ciberseguridad 2024 del INCIBE, el organismo gestionó 97.348 incidentes durante ese año —un 16,6% más que en 2023—, de los cuales el 32,4% afectaron directamente a empresas, incluyendo PYMEs y autónomos (INCIBE, 2025). Muchos de esos incidentes se agravan porque las empresas no detectan el problema hasta que ya ha escalado y el daño —en tiempo, datos o reputación— es mayor de lo que habría sido con detección temprana.
La monitorización continua invierte este escenario: actúas antes de que el usuario lo note.
Qué incluye la monitorización de infraestructura IT de una PYME
Una monitorización completa cubre cuatro capas diferenciadas. Ignorar cualquiera de ellas genera puntos ciegos que tarde o temprano se convierten en incidentes.
Servidores y máquinas virtuales
Es la capa más crítica. Un servidor de ficheros, el controlador de dominio Active Directory o el servidor ERP (Enterprise Resource Planning) son activos cuya caída paraliza a toda la empresa simultáneamente.
Métricas a vigilar en cada servidor:
- Uso de CPU: alerta si supera el 80% durante más de 5 minutos consecutivos. Picos puntuales son normales; la sostenida durante minutos indica un proceso descontrolado o un ataque en progreso.
- Memoria RAM disponible: alerta cuando queda menos del 10% libre. Los servidores con RAM agotada empiezan a usar paginación en disco, lo que degrada el rendimiento exponencialmente.
- Espacio en disco: dos umbrales —aviso al 85% de uso y crítico al 95%—. Un disco lleno puede detener servicios de base de datos o impedir que los backups se completen sin aviso previo.
- Estado de servicios clave: que Active Directory, SQL Server, el agente antivirus o el servidor de impresión estén activos. Un proceso puede fallar sin que el servidor caiga.
- Temperatura de hardware: relevante en servidores físicos. La tecnología S.M.A.R.T. (Self-Monitoring, Analysis and Reporting Technology) en discos permite anticipar fallos antes de que se produzcan.
En IBERSYA monitorizamos los servidores de nuestros clientes con agentes Zabbix instalados en cada máquina, que envían métricas al servidor central cada 60 segundos. Cuando un proceso crítico cae, el sistema lo detecta en menos de 2 minutos y lanza la alerta automáticamente —sin esperar a que ningún usuario lo reporte.
Red: switches, routers y cortafuegos
La red es invisible hasta que falla. Un puerto del switch que empieza a dar errores de CRC, un router con latencia creciente o un cortafuegos al 95% de su capacidad de sesiones son señales previas a una caída total que rara vez se detectan sin monitorización.
Qué vigilar en la capa de red:
- Disponibilidad de dispositivos: ping ICMP cada 60 segundos a cada switch, router y punto de acceso.
- Uso de CPU y memoria del router o switch mediante SNMP (Simple Network Management Protocol), el protocolo estándar para interrogar el estado de dispositivos de red.
- Errores de interfaz: paquetes perdidos, colisiones, errores CRC. Un puerto con más de 50 errores por minuto es una señal de degradación que anticipa cortes.
- Latencia interna: tiempo de respuesta entre segmentos de red. Una latencia creciente en la red local indica saturación o problemas en el cableado.
- Estado de las interfaces WAN: la línea de acceso a internet es el primer punto de fallo en la mayoría de las PYMEs. Monitorizar su disponibilidad y latencia con alertas inmediatas reduce el tiempo de detección de caídas de decenas de minutos a segundos.
Para dispositivos de red que no admiten instalación de agente software, Zabbix usa SNMP para interrogar el estado directamente desde el switch o router sin necesitar acceso administrativo al sistema operativo del dispositivo.
Aplicaciones y servicios críticos
Los servidores pueden estar operativos y las aplicaciones caídas. La monitorización a nivel de aplicación comprueba que el servicio responde correctamente —no solo que el proceso aparece como activo en el sistema operativo.
Tipos de comprobaciones de aplicación:
- HTTP/HTTPS: verificar que el servidor web devuelve código 200 y que el tiempo de carga es inferior a 3 segundos. Si sube a 8-10 segundos, la experiencia de usuario ya es inaceptable aunque técnicamente el servicio esté “arriba”.
- Base de datos: que el servidor MySQL, PostgreSQL o SQL Server acepta conexiones y responde queries de prueba en tiempo normal.
- Servicios de correo: que el servidor SMTP e IMAP responden en el puerto y en el tiempo esperados.
- ERP: en clientes con Odoo, comprobamos que la interfaz web devuelve respuesta y que el servicio
odoo.serviceestá activo. Cualquier parada del ERP es una parada operativa directa para la empresa.
Dispositivos de usuario y periféricos de red
Ordenadores, portátiles, impresoras de red y puntos de acceso Wi-Fi completan el inventario. No todos necesitan el mismo nivel de vigilancia, pero tener visibilidad de su estado permite detectar dispositivos con disco al límite, sin actualizaciones críticas aplicadas o sin el agente antivirus activo.
Para la gestión centralizada de dispositivos fuera de la red corporativa —portátiles de empleados en remoto, móviles de empresa—, el servicio de gestión de dispositivos móviles complementa la monitorización de infraestructura y cierra ese punto ciego.
¿Tu empresa detecta los problemas cuando ya los reportan los usuarios?
En IBERSYA configuramos la monitorización de infraestructura IT con Zabbix y Grafana para PYMEs de 15 a 100 empleados, incluyendo alertas automáticas e integración con el sistema de soporte.
Solicita una valoración gratuita.
Cómo implantar Zabbix y Grafana en una PYME paso a paso
Paso 1: Instalar el servidor Zabbix
Zabbix Server se instala sobre Linux —Ubuntu Server 22.04 LTS o 24.04 LTS son las distribuciones más estables para entornos de producción. Los requisitos mínimos para una PYME de hasta 50 dispositivos son 2 vCPU y 4 GB de RAM. Puede correr en una máquina virtual sobre el hipervisor que ya tengas (VMware, Hyper-V o Proxmox).
Descarga los paquetes oficiales desde zabbix.com y sigue el asistente de instalación. Requiere configurar una base de datos (MySQL 8.0 o PostgreSQL 15+) y el servidor web Apache o Nginx para la interfaz de administración.
Tiempo estimado de instalación desde cero: entre 1 y 2 horas para alguien familiarizado con Linux. La configuración inicial de todos los dispositivos añade entre 2 y 4 horas adicionales según el tamaño de la infraestructura.
Paso 2: Añadir los dispositivos a monitorizar
Para cada servidor Windows o Linux, instala el agente Zabbix —paquete gratuito disponible en la web oficial para todas las plataformas—. El agente se conecta al servidor central en modo activo (el agente envía datos) o pasivo (el servidor interroga al agente).
Para dispositivos de red sin capacidad de instalar software:
- Activa SNMP v2c o v3 en el switch o router desde su interfaz de administración.
- Añade el dispositivo en Zabbix como host con interfaz SNMP y la community string correspondiente.
- Asigna la plantilla de red del fabricante —Zabbix incluye plantillas oficiales para Cisco, HP/Aruba, Ubiquiti y Mikrotik, entre otros.
En Zabbix 7.0 (versión actual a septiembre de 2026), el módulo de autodescubrimiento puede identificar dispositivos nuevos en rangos de IP definidos y añadirlos automáticamente como hosts, lo que simplifica mucho la incorporación de infraestructura nueva.
Paso 3: Configurar umbrales y alertas
Los triggers en Zabbix son las condiciones que disparan una alerta. Las plantillas incluyen triggers predefinidos, pero es imprescindible ajustarlos a la infraestructura concreta para evitar dos problemas: falsos positivos (alertas que no corresponden a incidencias reales) y umbrales demasiado permisivos (que detectan el problema tarde).
Umbrales de referencia para PYMEs:
| Métrica | Aviso (Warning) | Crítico |
|---|---|---|
| CPU del servidor | >80% durante 5 min | >95% durante 2 min |
| RAM libre | <15% | <5% |
| Disco libre | <20% | <10% |
| Disponibilidad host | Sin respuesta 2 min | Sin respuesta 5 min |
| Tiempo respuesta HTTP | >2 segundos | >5 segundos |
| Temperatura servidor físico | >65 °C | >80 °C |
| Errores de interfaz de red | >50 errores/min | >200 errores/min |
Para las notificaciones, configura al menos dos canales: email para alertas de aviso y mensajería instantánea (Teams o Telegram) para alertas críticas que requieren respuesta inmediata, incluso fuera del horario habitual.
Paso 4: Conectar Grafana para los dashboards
Grafana se instala de forma independiente a Zabbix y se conecta mediante el plugin oficial de Zabbix disponible en el marketplace de Grafana. Una vez instalado y configurado:
- Añade Zabbix como datasource en Grafana con la URL del servidor y las credenciales de solo lectura.
- Importa un dashboard base desde la biblioteca pública de Grafana (busca “Zabbix” en grafana.com/grafana/dashboards —hay más de 30 dashboards listos para usar).
- Personaliza los paneles para mostrar: disponibilidad de todos los hosts, uso de CPU y RAM por servidor, estado de la WAN y los 10 hosts con más alertas en las últimas 24 horas.
El resultado es un panel de control visual accesible desde cualquier navegador —incluso en móvil—, que muestra el estado de toda la infraestructura de un vistazo sin necesidad de entrar en la interfaz de Zabbix.
Para la configuración de alertas automáticas ante servicios caídos con reinicio automático —un complemento habitual a la monitorización básica—, el post sobre cómo detectar servicios colgados y reiniciarlos automáticamente con Zabbix explica el proceso en detalle.
Qué más aporta la monitorización más allá de las alertas en tiempo real
La monitorización continua genera datos históricos que tienen valor operativo bien más allá de detectar fallos cuando ocurren:
Planificación de capacidad. Las gráficas de uso de disco a lo largo de los meses muestran la tendencia de crecimiento con exactitud. Si el disco crece a un ritmo de 2 GB por semana, el sistema puede calcular cuándo se agotará y generar una alerta predictiva con semanas o meses de margen —sin depender de que alguien lo revise manualmente.
Detección temprana de hardware degradado. Un servidor cuya CPU empieza a trabajar más de lo habitual sin cambios en la carga de trabajo, o un disco con lecturas S.M.A.R.T. que muestran sectores reasignados crecientes, son señales de fallo inminente. Con monitorización se ven semanas antes de que el hardware falle en producción.
Evidencias para decisiones de inversión. Cuando el responsable IT necesita justificar ante gerencia la renovación de un servidor o la ampliación del ancho de banda, los datos de Zabbix —picos de CPU recurrentes, latencia de red creciente, días con tiempo de respuesta degradado— son argumentos objetivos y medibles, no estimaciones.
Correlación con incidentes pasados. Si un usuario reportó que “la aplicación iba lenta el martes a las 10:30”, los datos históricos de Zabbix permiten ver exactamente qué ocurrió en ese momento: qué proceso consumió la CPU, si hubo pérdida de paquetes en la red o si el disco de la base de datos llegó al 100% de escritura.
En IBERSYA Consultoría S.L., la monitorización nos permite detectar entre el 60% y el 70% de los problemas antes de que cualquier usuario los reporte, reduciendo las llamadas de soporte urgente y el tiempo improductivo de los equipos de nuestros clientes.
Errores frecuentes en la monitorización IT de PYMEs
Monitorizar solo el ping. Un servidor que responde al ping puede tener la base de datos caída, el disco al 99% o la memoria agotada. El ping comprueba exclusivamente que el dispositivo está encendido y conectado a la red —no que funcione correctamente. Limitarse al ping es la forma más común de tener una falsa sensación de seguridad.
Configurar alertas sin plan de escalado. Si las alertas llegan solo al email del responsable IT y este está de vacaciones o en una reunión sin móvil, el fallo no se detecta hasta que alguien llama. Configura siempre al menos dos contactos de notificación y un canal de urgencia —SMS o llamada automatizada— para alertas críticas fuera del horario labitual.
No ajustar los umbrales de las plantillas. Las plantillas estándar de Zabbix están calibradas para infraestructuras genéricas. En una PYME con un servidor ERP que hace picos de CPU al 90% cada noche durante el proceso de cierre, ese umbral no es una alerta: es el comportamiento esperado. Sin ajustar los umbrales a la realidad de la empresa, el sistema genera decenas de falsos positivos hasta que el equipo aprende a ignorarlos —y entonces ignoran también los que sí son reales.
No monitorizar las copias de seguridad. El backup fallido es uno de los problemas más críticos que menos se detecta. Añade en Zabbix una comprobación del estado del último backup: si el script no ha generado el archivo esperado en las últimas 24 horas, lanza una alerta crítica de inmediato. Descubrir en el momento de una pérdida de datos que el backup llevaba semanas sin completarse es uno de los peores escenarios evitables.
Dejar la monitorización desactualizada. Cada vez que se añade un servidor, se cambia un switch o se instala una aplicación crítica, la configuración de Zabbix debe actualizarse. Una monitorización que no refleja la infraestructura real tiene puntos ciegos que invalidan toda la inversión en el sistema. Programa una revisión trimestral de la configuración y actualízala inmediatamente ante cualquier cambio de infraestructura.
Instalar Zabbix pero no mirar los datos. La monitorización solo funciona si alguien revisa periódicamente los dashboards de tendencias —no solo las alertas activas. Los problemas más costosos suelen anunciarse semanas antes en forma de tendencias graduales que ninguna alerta de umbral inmediato detecta. Una revisión semanal de 15 minutos sobre los datos históricos es suficiente para captarlos.
Preguntas frecuentes sobre monitorización de infraestructura IT
¿Qué es la monitorización de infraestructura IT?
La monitorización de infraestructura IT es el proceso de supervisar en tiempo real servidores, red, aplicaciones y dispositivos de una empresa para detectar fallos antes de que afecten a la operativa. Herramientas como Zabbix ejecutan comprobaciones automáticas cada 30-60 segundos y lanzan alertas cuando algo sale de los umbrales normales.
¿Cuánto cuesta implementar Zabbix en una PYME?
Zabbix es software de código abierto y no tiene coste de licencia. El coste para una PYME proviene del servidor o máquina virtual donde se aloja (desde 50-80 €/mes en la nube) y de la implantación inicial, que suele estar entre 800 y 2.000 € según el número de dispositivos y la complejidad de las alertas.
¿Qué diferencia hay entre Zabbix y Grafana?
Zabbix es el motor de monitorización: recoge métricas, ejecuta comprobaciones activas y lanza alertas automáticas. Grafana es la capa de visualización: convierte esos datos en dashboards interactivos y gráficas en tiempo real. Funcionan mejor juntos —Zabbix como fuente de datos y Grafana como panel de control visual— que por separado.
¿Con cuántos dispositivos tiene sentido implantar monitorización IT?
Con 10 o más dispositivos (ordenadores, servidores, switches, NAS) la monitorización automática empieza a ser rentable. A partir de 25 dispositivos es prácticamente obligatoria para evitar paradas no detectadas. Por debajo de 10 dispositivos, un checklist semanal manual puede ser suficiente mientras la empresa crece.
En IBERSYA Consultoría S.L. implantamos la monitorización de infraestructura IT con Zabbix y Grafana para empresas de 15 a 100 empleados: configuración de umbrales, dashboards en tiempo real, alertas integradas con Teams y revisión trimestral del sistema. Si quieres visibilidad completa de tu infraestructura sin invertir tiempo interno en la configuración, cuéntanos cuántos dispositivos tienes y qué nivel de cobertura necesitas.