Ich hab die letzten Wochen an einer neuen Custom Integration namens Automation Monitor gebastelt und wollte sie euch kurz vorstellen.
Die Idee: Zwei Dinge können bei einer Automation schiefgehen, und genau die überwacht die Integration mit zwei unabhängigen Sensoren:
sensor.failed_automations – erkennt, wenn eine Automation tatsächlich gelaufen ist und dabei ein echter Laufzeitfehler aufgetreten ist (ausgelesen über die Trace-API, nicht per Log-Parsing).
sensor.linked_entities_unavailable – deckt einen Fall ab, den die Trace-basierte Erkennung gar nicht sehen kann: Eine Entity, die von euren Automationen/Skripten referenziert wird, hängt dauerhaft auf unavailable fest (z. B. ein abgeschmiertes Zigbee-Gerät) – auch wenn noch gar keine Automation versucht hat, sie anzusteuern.
Beide Sensoren liefern strukturierte Daten (Listen als Attribute), keine fertige Dashboard-Card – wie ihr das anzeigt oder darauf reagiert (Markdown-Card, auto-entities, eigene Automation), bleibt euch überlassen. Optional gibt’s pro Sensor eine Persistent Notification, unabhängig voneinander togglebar.
Sinnvoll zu kombinieren mit Watchman: Watchman prüft statisch (fehlende Entities/Services in der Config), Automation Monitor deckt die Laufzeit-Fehler ab, die erst beim tatsächlichen Ausführen auftreten.
Installation: aktuell nur über HACS als Custom Repository (noch nicht im offiziellen Store gelistet), Voraussetzung ist HA 2024.1+.
Feedback, Bug-Reports und Testläufe auf euren Systemen sind willkommen – vor allem die Erkennung der aborted-Fälle würde ich gerne noch breiter getestet sehen.
