Monitore, die seit Wochen rot sind, stumpfen ab und verdecken echte Probleme. Mit einer SQL-Abfrage finden Sie alle dauerhaft kritischen Unit Monitore – und damit das größte Optimierungspotenzial.
In vielen Operations-Manager-Umgebungen gibt es Monitore, die seit Tagen, Wochen oder Monaten im kritischen Zustand stehen – ohne dass jemand reagiert. Sie sind entweder Fehlalarme, die angepasst werden müssen, oder echte Probleme, die niemand löst. Beides ist schlecht: Das Team gewöhnt sich an Rot, und neue Probleme fallen nicht mehr auf.
Die Abfrage
Die folgende Leseabfrage gegen die Betriebsdatenbank (OperationsManager) listet alle kritischen Unit Monitore mit Alarm, zusammen mit dem betroffenen Objekt, dem Host und der Dauer im kritischen Zustand:
SELECT sc.TimeGenerated,
DATEDIFF(MINUTE, sc.TimeGenerated, GETUTCDATE()) AS [Minuten kritisch],
host.DisplayName AS [Host],
ISNULL(bme.Path, bme.DisplayName) AS [Pfad],
bme.DisplayName AS [Objekt],
mt.TypeName AS [Klasse],
mv.DisplayName AS [Monitor],
mv.Description AS [Beschreibung]
FROM BaseManagedEntity bme
JOIN StateView s ON s.BaseManagedEntityId = bme.BaseManagedEntityId
JOIN MonitorView mv ON mv.Id = s.MonitorId
JOIN BaseManagedEntity host ON host.BaseManagedEntityId = bme.TopLevelHostEntityId
JOIN ManagedType mt ON mt.ManagedTypeId = bme.BaseManagedTypeId
JOIN (SELECT BaseManagedEntityId, MonitorId, MAX(TimeGenerated) AS TimeGenerated
FROM StateChangeEventView
WHERE NewHealthState = 3
GROUP BY BaseManagedEntityId, MonitorId) sc
ON sc.BaseManagedEntityId = bme.BaseManagedEntityId AND sc.MonitorId = s.MonitorId
WHERE s.HealthState = 3
AND mv.IsUnitMonitor = 1
AND mv.AlertPriority = 1
ORDER BY [Minuten kritisch] DESC;
Mit einer zusätzlichen Bedingung auf host.DisplayName beschränken Sie die Ausgabe auf einen einzelnen Server.
Die Ergebnisse auswerten
Sortiert nach Dauer zeigt die Liste schnell, wo das größte Potenzial liegt:
- Viele Objekte, gleicher Monitor: Ein Hinweis auf einen unpassenden Schwellwert oder einen Monitor, der in Ihrer Umgebung keinen Sinn ergibt – per Override anpassen oder für eine Gruppe deaktivieren.
- Einzelne Objekte seit Wochen kritisch: Ein echtes Problem, das niemand bearbeitet – Verantwortlichkeit klären.
- Objekte, die es nicht mehr gibt: Verwaiste Objekte nach Abbau oder Migration – bereinigen.
Tipp
Führen Sie die Auswertung regelmäßig durch, zum Beispiel monatlich, und verfolgen Sie die Anzahl dauerhaft kritischer Monitore als Kennzahl. Sie ist ein guter Indikator dafür, wie gut eine SCOM-Umgebung gepflegt ist.
Heute
Die verwendeten Views sind in Operations Manager 2019, 2022 und 2025 vorhanden. Führen Sie Abfragen auf der Betriebsdatenbank nur lesend und außerhalb von Lastspitzen aus.