Volume-Audit läuft nicht mehr

Alert: VolumeUidAuditOverdue
Warning Meta-Alert (Audit-Timer)
🔇
Niedriges direktes Risiko, aber du verlierst eine Sicherheitsnetz-Funktion. Solange der Audit nicht läuft, würden neue Volume-UID-Probleme nicht entdeckt.

Was bedeutet das?

Der wöchentliche Volume-Audit (jeden Mittwoch 06:00) ist seit über 9 Tagen nicht mehr durchgelaufen. Die Metrik volume_uid_audit_last_run_unixtime ist alt.

Das ist ein Meta-Alert — er feuert nicht für ein echtes Volume-Problem, sondern dafür, dass der Prüf-Mechanismus selbst kaputt ist.

⚠️Wie schlimm ist es?

Niedrig direkt — aber wenn der Audit weiter ausfällt und gleichzeitig irgendwo ein Volume-UID-Mismatch entsteht, würde das nicht mehr alarmiert. Also: diese Woche fixen, sonst summiert sich Risiko über die Wochen.

🔧Was tun?

  1. Timer-Status:
    systemctl status eplamat-volume-audit.timer
    systemctl list-timers eplamat-volume-audit.timer
    Wenn disabled: sudo systemctl enable --now eplamat-volume-audit.timer
  2. Service manuell triggern — pusht eine frische Metrik:
    sudo systemctl start eplamat-volume-audit.service
    journalctl -u eplamat-volume-audit.service --since "2 min ago" | tail -30
    Am Ende muss metric push OK stehen.
  3. Push-Endpoint testbar?
    curl -s http://localhost:9092/metrics | grep volume_uid_audit_last_run
    Wert ist der aktuelle Unix-Timestamp.
  4. Alarm cleared nach 1h (Prometheus for: 1h).

🆘Wenn das nicht klappt

Kopier den Alert in Claude. Typische Ursachen: systemd-Timer disabled nach Reboot, Pushgateway nicht erreichbar, oder das Audit-Script selbst hat einen Bug (z.B. nsenter failed massiv).