Kontakt aufnehmen

Schulungsübersicht

Einführung in erweitertes Alerting

  • Kernprinzipien des Alertings in IT-Systemen
  • Übersicht über den Prometheus Alertmanager
  • Alerting-Möglichkeiten in Grafana

Erstellung erweitelter Alert-Regeln

  • Definition von Alert-Regeln in Prometheus
  • Einsatz von Labels und Annotationen für Alerts
  • Gruppierungsbestrategien und Stummschaltungsmassnahmen

Integration des Alertmanagers mit externen Systemen

  • Konfiguration von Webhooks für externe Integrationen
  • Integration mit Tools wie Slack, PagerDuty und E-Mail-Systemen
  • Anpassung der Alertmanager-Vorlagen

Automatisierung von Reaktionen auf Alerts

  • Umsetzung automatisierter Remediation-Workflows
  • Integration mit Orchestrierungstools (z. B. Ansible, Kubernetes)
  • Einsatz von Scripts zur automatisierten Problemlösung

Visualisierung von Alerts in Grafana

  • Einrichtung von Alert-Panels in Grafana
  • Anpassung von Alert-Benachrichtigungen und Schwellwerten
  • Best Practices für das Monitoring des Alert-Status

Verwaltung von High-Volume-Alerts

  • Effektive Behandlung von Alert-Stürmen
  • Optimierung der Prometheus-Leistung für das Alerting
  • Skalierbarkeitsüberlegungen für den Alertmanager

Skalierung und fortgeschrittene Techniken

  • Distribuierte Alerting-Setups mit Prometheus und Alertmanager
  • Integration von cloudbasierten Alerting-Lösungen
  • Erforschung neuer Funktionen in den Grafana- und Prometheus-Ökosystemen

Zusammenfassung und nächste Schritte

Voraussetzungen

  • Basiserfahrung mit Grafana und Prometheus
  • Kenntnisse in IT-Monitoring-Konzepten
  • Vertrautheit mit Scripting oder Programmierung zur Automatisierung

Zielgruppe

  • DevOps-Ingenieure
  • Site Reliability Engineers (SREs)
 14 Stunden

Teilnehmerzahl


Preis je Teilnehmer (exkl. USt)

Erfahrungsberichte (2)

Kommende Kurse

Verwandte Kategorien