Volume-Audit läuft nicht mehr
Alert:
VolumeUidAuditOverdue
Warning
Meta-Alert (Audit-Timer)
❓Was bedeutet das?
Der wöchentliche Volume-Audit (jeden Mittwoch 06:00) ist seit über 9 Tagen nicht mehr durchgelaufen. Die Metrik volume_uid_audit_last_run_unixtime ist alt.
Das ist ein Meta-Alert — er feuert nicht für ein echtes Volume-Problem, sondern dafür, dass der Prüf-Mechanismus selbst kaputt ist.
⚠️Wie schlimm ist es?
Niedrig direkt — aber wenn der Audit weiter ausfällt und gleichzeitig irgendwo ein Volume-UID-Mismatch entsteht, würde das nicht mehr alarmiert. Also: diese Woche fixen, sonst summiert sich Risiko über die Wochen.
🔧Was tun?
- Timer-Status:
Wenn disabled:systemctl status eplamat-volume-audit.timer systemctl list-timers eplamat-volume-audit.timersudo systemctl enable --now eplamat-volume-audit.timer - Service manuell triggern — pusht eine frische Metrik:
Am Ende musssudo systemctl start eplamat-volume-audit.service journalctl -u eplamat-volume-audit.service --since "2 min ago" | tail -30metric push OKstehen. - Push-Endpoint testbar?
Wert ist der aktuelle Unix-Timestamp.curl -s http://localhost:9092/metrics | grep volume_uid_audit_last_run - Alarm cleared nach 1h (Prometheus
for: 1h).
🆘Wenn das nicht klappt
Kopier den Alert in Claude. Typische Ursachen: systemd-Timer disabled nach Reboot, Pushgateway nicht erreichbar, oder das Audit-Script selbst hat einen Bug (z.B. nsenter failed massiv).