Die Targets standen seit dem ersten Scrape auf der oeffentlichen IP und waren
nie up. Ursache jetzt belegt: Die Exporter-Container auf dem Game-Host
veroeffentlichen ihre Ports gar nicht - docker ps zeigt "9100/tcp" ohne
0.0.0.0-Mapping, sie sind nur im Docker-Netz erreichbar. Weder Firewall noch
Bind-Adresse, wie bisher vermutet.
Targets auf 10.0.0.4 umgestellt (Host liegt im vSwitch, 22/80/443 antworten
dort). cadvisor bewusst auf Host-Port 8081: 8080 ist von coolify-proxy belegt.
Neu angebunden: pterodactyl_exporter auf 9531 - laeuft dort seit drei Monaten
und war nie im Monitoring.
README nachgezogen; sie nannte weiterhin die oeffentliche IP und beschrieb die
Targets als "antworten aktuell nicht", ohne den Grund.
⚠️ Wirksam erst, wenn die Ports auf dem Game-Host auf 10.0.0.4 veroeffentlicht
sind. Bis dahin bleiben die Targets down - unveraendert zum Zustand davor, nur
mit richtiger Adresse und dokumentierter Ursache.
84 lines
2.8 KiB
YAML
84 lines
2.8 KiB
YAML
global:
|
|
scrape_interval: 15s
|
|
|
|
rule_files:
|
|
- /etc/prometheus/alerts.yml
|
|
|
|
alerting:
|
|
alertmanagers:
|
|
- static_configs:
|
|
- targets: ["alertmanager:9093"]
|
|
|
|
# Zusaetzlich zu diesen Scrape-Targets kommen Metriken per Remote-Write rein
|
|
# (k3s-Cluster: flux, kube_state_metrics; Matrix-Server: synapse).
|
|
scrape_configs:
|
|
## Operating-Server (dieser Host)
|
|
- job_name: "operating_prometheus"
|
|
static_configs:
|
|
- targets: ["localhost:9090"]
|
|
|
|
- job_name: "operating_node-exporter"
|
|
static_configs:
|
|
- targets: ["node-exporter:9100"]
|
|
|
|
- job_name: "operating_cadvisor"
|
|
# cadvisor laeuft im Portainer-Stack "thread-net-git", selbes traefik-Netz
|
|
static_configs:
|
|
- targets: ["cadvisor:8080"]
|
|
|
|
# Alertmanager-Eigenmetriken. Ohne diesen Job sind ZUSTELLfehler unsichtbar:
|
|
# Prometheus kennt alertmanager zwar als Alarm-Ziel (oben unter alerting:),
|
|
# scrapt ihn aber nicht - eine still reissende Alarmkette waere also genau das,
|
|
# was niemand meldet. Liefert u.a. alertmanager_notifications_failed_total.
|
|
- job_name: "operating_alertmanager"
|
|
static_configs:
|
|
- targets: ["alertmanager:9093"]
|
|
|
|
- job_name: "operating_traefik"
|
|
metrics_path: "/metrics"
|
|
static_configs:
|
|
- targets: ["traefik:8080"]
|
|
|
|
## Externe Hosts
|
|
- job_name: "k3s_host_node"
|
|
static_configs:
|
|
- targets: ["10.0.0.2:9100"]
|
|
labels:
|
|
instance: "k3s-host"
|
|
|
|
# Game-Host: privat ueber den vSwitch statt ueber die oeffentliche IP (management
|
|
# #0002). Bis 2026-08-20 standen hier 157.90.155.206:9100 und :8080 - beide Ports
|
|
# waren von aussen gefiltert, die Targets seit dem ersten Scrape dauerhaft down.
|
|
#
|
|
# ⚠️ Voraussetzung auf dem Game-Host: Die Exporter-Container veroeffentlichen ihre
|
|
# Ports gar nicht (docker ps zeigt "9100/tcp" ohne 0.0.0.0-Mapping) - sie sind nur
|
|
# im Docker-Netz erreichbar. Sie muessen auf 10.0.0.4 veroeffentlicht werden, nicht
|
|
# auf 0.0.0.0: Letzteres oeffnete sie wieder oeffentlich, was dieses Issue vermeidet.
|
|
#
|
|
# cadvisor liegt bewusst auf Host-Port 8081, nicht 8080: Dort haengt bereits
|
|
# coolify-proxy (traefik) auf 0.0.0.0:8080, ein Bind auf 10.0.0.4:8080 kollidierte.
|
|
- job_name: "pterodactyl_host_node"
|
|
static_configs:
|
|
- targets: ["10.0.0.4:9100"]
|
|
labels:
|
|
instance: "pterodactyl"
|
|
|
|
- job_name: "gameserver_cadvisor"
|
|
static_configs:
|
|
- targets: ["10.0.0.4:8081"]
|
|
labels:
|
|
instance: "pterodactyl"
|
|
|
|
# Pterodactyl-eigene Metriken (Server, Spieler, Auslastung je Instanz). Laeuft auf
|
|
# dem Game-Host schon seit drei Monaten, war aber nie angebunden.
|
|
- job_name: "pterodactyl_exporter"
|
|
static_configs:
|
|
- targets: ["10.0.0.4:9531"]
|
|
labels:
|
|
instance: "pterodactyl"
|
|
|
|
# CVE-Exporter (gitops#47)
|
|
- job_name: "cve_exporter"
|
|
static_configs:
|
|
- targets: ["cve-exporter:9101"]
|