Saltar al contenido
Logotipo de Trainontech Trainontech

Infraestructura, DevOps y Cloud · INF-110

Monitorización de infraestructura

Métricas de sistema con Prometheus y paneles de Grafana con alertas que alguien atiende de verdad.

Próximamente Avanzado 6 módulos · 29 clases

Formato asíncrono Ingeniería / Industria, Desarrollo Grafana, Prometheus, Docker

Lo que aprenderás

  • Desplegar Prometheus, Grafana y los exporters de sistema y contenedores con docker compose.
  • Configurar el descubrimiento de objetivos y comprobar el estado de cada scrape.
  • Escribir consultas PromQL con rate, increase y agregaciones por etiqueta.
  • Construir paneles legibles con variables, unidades correctas y umbrales visuales.
  • Definir reglas de alerta con condiciones sostenidas y enviarlas por correo o mensajería.
  • Dimensionar la retención y el almacenamiento de métricas según el volumen de series.

Contenido del curso

6 módulos · 29 clases en vídeo · práctica guiada en cada módulo

Módulo 1 · Presentación y entorno 4 clases
  • Qué medir y por qué: síntomas frente a causas
  • Arquitectura de Prometheus y modelo de datos
  • Levantar la pila con docker compose
  • Primer acceso a Grafana y a la interfaz de Prometheus
Módulo 2 · Recogida de métricas 5 clases
  • Node exporter: métricas de CPU, memoria, disco y red
  • Métricas de contenedores
  • Configurar objetivos y descubrimiento
  • Diagnosticar un objetivo caído o incompleto
  • Instrumentar una aplicación propia
Módulo 3 · PromQL en la práctica 5 clases
  • Tipos de métrica: contador, medidor, histograma
  • rate e increase sobre contadores
  • Agregaciones por etiqueta y filtrado
  • Consultas para saturación, errores y latencia
  • Errores frecuentes que producen gráficas falsas
Módulo 4 · Paneles en Grafana 5 clases
  • Fuentes de datos y organización de paneles
  • Variables para reutilizar un panel entre servidores
  • Unidades, escalas y umbrales de color
  • Paneles de resumen frente a paneles de diagnóstico
  • Importar y adaptar paneles de la comunidad
Módulo 5 · Alertas que se atienden 5 clases
  • Reglas de alerta y condiciones sostenidas
  • Elegir umbrales sin inventarlos
  • Rutas de notificación y silenciamientos
  • Envío a correo y a mensajería del equipo
  • Revisar y retirar alertas ruidosas
Módulo 6 · Caso práctico: monitorizar una infraestructura real 5 clases
  • Inventario de servicios y métricas necesarias
  • Despliegue de la pila y de los exporters
  • Panel de operación y panel de guardia
  • Juego de alertas mínimo con procedimiento de respuesta
  • Retención, almacenamiento y mantenimiento continuado

Requisitos

  • Administración de Linux y manejo de servicios y ficheros de configuración.
  • Docker y docker compose para levantar la pila de monitorización.
  • Tener a mano al menos un servidor o un servicio propio que monitorizar.

Descripción

La monitorización suele fallar por dos motivos opuestos. O no hay nada, y la primera noticia de un problema la da el usuario; o hay demasiado, con paneles llenos de gráficas que nadie mira y alertas que se silencian el segundo día porque avisan de todo. En ambos casos, cuando llega una caída real se acaba entrando por SSH a mirar logs a mano.

El curso monta la pila completa: Prometheus recogiendo métricas de node exporter y de los contenedores, Grafana como capa de visualización y un gestor de alertas conectado a un canal real. Se trabaja PromQL a fondo, porque sin consultas correctas los paneles mienten, y se diseñan alertas con condiciones sostenidas y umbrales justificados en lugar de avisos por cada pico.

El resultado es un conjunto de paneles que responden a preguntas concretas de operación y una lista corta de alertas accionables, con su procedimiento de respuesta. Es la continuación natural del despliegue con contenedores y de la canalización de integración continua, y la base para monitorizar después clústeres o instalaciones industriales.

¿Para quién es este curso?

  • Ingenieros de sistemas responsables de servidores propios o de instalaciones en cliente.
  • Desarrolladores que operan sus propios despliegues y necesitan enterarse antes que el usuario.
  • Responsables técnicos de una PYME que quieren reducir el tiempo de detección de incidencias.
Próximamente

Curso en hoja de ruta. Se prioriza según la demanda recogida y los proyectos en cartera.

Código
INF-110
Nivel
Avanzado
Público
Ingeniería / Industria, Desarrollo
Entorno
Grafana, Prometheus, Docker

Este curso incluye

  • 29 clases en vídeo bajo demanda
  • Práctica en entornos web y simuladores, sin instalar nada
  • Tutorización en el campus
  • Acceso desde móvil, tableta y ordenador
  • Actualizaciones cuando cambia la versión de la herramienta
  • Certificado de finalización

Sigue aprendiendo

Cursos relacionados

Próximamente

INF-108Infraestructura, DevOps y Cloud

CI/CD con GitHub Actions y GitLab CI

Integración y despliegue continuos para proyectos pequeños que quieren dejar de romperse.

GitDocker

Avanzado 31 clases

Próximamente

INF-111Infraestructura, DevOps y Cloud

Infraestructura como código con Ansible

Provisionar y mantener decenas de equipos o Raspberry Pi de forma reproducible.

AnsibleLinux

Avanzado 27 clases