Scrape-Target nicht erreichbar

Alert: TargetDown
Critical Service-spezifisch
🎯
Was genau down ist, steht im Alarm: Scrape target {job}/{instance}. Schwere variiert stark je nach Target — fritz_exporter ist kosmetisch, paperless-metrics ist Funktionseinschränkung.

Was bedeutet das?

Ein in prometheus.yml konfiguriertes Scrape-Target antwortet seit über 2 Min nicht. Mögliche Targets:

⚠️Wie schlimm ist es?

Hängt vom Job ab:

🔧Was tun?

  1. Welches Target? Im Alarm steht job=... und instance=.... Oder live:
    curl -s http://localhost:9090/api/v1/targets | python3 -c "
    import sys,json
    for t in json.load(sys.stdin)['data']['activeTargets']:
        if t['health'] != 'up':
            print(t['labels']['job'], '→', t['scrapeUrl'], t.get('lastError','no error'))"
  2. Container des Targets neu starten:
    docker compose ps <name>
    docker compose restart <name>
  3. Test direkt: Prometheus-UI öffnen → https://prometheus.home.mattetat.org/targets → siehst farbige Health-Anzeige + letzte Fehlermeldung.
  4. Wenn ganz blockiert (z.B. nach DNS-Änderung — siehe CLAUDE.md): alle Container restarten:
    cd /srv/eplamat && docker compose restart

🆘Wenn das nicht klappt

Kopier den Alert in Claude (inkl. dem genauen {job}/{instance}). Manche Targets brauchen spezifisches Wissen (z.B. fritz_exporter nach Router-Firmware-Update braucht TLS-Cert-Re-Trust).