Projekt · Monitoring
Netzwerk- und Server-Monitoring mit dem Elastic Stack
Alle Daten laufen in einem Dashboard zusammen, das den Zustand der wichtigsten Geräte und Verbindungen zeigt.
- Monitoring und Reaktion 24/7 im Vertrag
- Ein Team für Ihre gesamte IT
- Was Ihren Betrieb aufhält, hat Vorrang
Grundlage
Monitoring unter Ihrer Kontrolle
Die gesamte Monitoring-Umgebung läuft lokal im Unternehmen mit der Basic-Lizenz. Es gibt kein Abonnement, und Daten über die IT-Infrastruktur verlassen das Unternehmen nicht.
Wir konfigurieren die Lösung für Ihre konkrete Umgebung und rechnen sie nicht ausschließlich nach der Anzahl der Geräte ab. Den Elastic Stack stellen wir für Ihr konkretes Netzwerk zusammen, von den Datenquellen über deren Verarbeitung bis zu den Ansichten, die tatsächlich genutzt werden.
Datenerfassung
Datenquellen
Wir erfassen die Daten dort, wo sie entstehen. Logstash empfängt SNMP-Daten von Netzwerkgeräten und liest das System-Syslog. Filebeat sammelt verschiedenste Logs, Winlogbeat die Windows-Ereignisprotokolle und Metricbeat die Leistungsmetriken.
Alle Daten werden in einem gemeinsamen Datenspeicher in Elasticsearch abgelegt. So stehen der Eintrag eines Switches, das Ereignis eines Windows-Servers und die Metrik einer Maschine in einer Ansicht zur Verfügung, statt auf vier separate Tools verteilt zu sein.
Betriebsübersicht
Ein Bildschirm, eine Antwort in 30 Sekunden
Ein einziges vollständiges Dashboard führt all diese Daten zusammen und bietet einen direkten Überblick über die wichtigsten Netzwerkknoten. Es zeigt die Auslastung der Verbindungen und die Antwortzeiten der Knoten.
Das Ziel ist einfach und messbar. Innerhalb von 30 Sekunden nach dem Öffnen dieser Ansicht wissen Sie, ob im Netzwerk etwas geschieht. Sie müssen sich nicht nacheinander bei den Geräten anmelden und nicht raten, wo Sie beginnen sollen.
Alarmierung
Alarme, die einen Menschen erreichen
Monitoring ohne Alarme ist nur ein Diagramm. Schwellenwerte überwachen Ressourcen und ausgewählte Fehler in den Logs. Den Benachrichtigungskanal wählen wir nach der Bedeutung des Ereignisses aus, von einer E-Mail bis zum Anruf in kritischen Fällen.
Ressourcen unter dem Schwellenwert
Festplattenbelegung, CPU und Arbeitsspeicher. Ein Alarm wird ausgelöst, bevor Speicherplatz oder Rechenleistung knapp werden.
Fehler in den Logs
Analyse der Logs auf ausgewählte Fehler, nicht nur das Sammeln von Daten.
E-Mail, SMS und Chat
Benachrichtigungen werden an den Kanal gesendet, den das Team täglich nutzt.
Ergebnisse
- Rund 200 Router und die übrigen Netzwerkgeräte werden gemeinsam überwacht.
- Je nach Tag gibt es einige wenige bis mehrere Dutzend Alarme pro Tag.
- Die Benachrichtigungen gehen an rund ein Dutzend Personen auf Kundenseite.
