docs: close #0030 — the question in its title was answered a week ago

The subject of the issue was whether the backups were a guess. That was
settled on 14.08. with restored row counts rather than an assurance, and
the title has been wrong ever since. It also sat at in-progress for a week
without work. Third issue today with the same stale-head class.

Two things measured while closing, neither of them in the text:

restore-drill has never fired on schedule. lastScheduleTime is none - the
job was created on 14.08. and runs on the 4th, so the first automatic run
is 04.09. Only the manual run has passed. Every other cronjob in the
cluster shows a fresh timestamp; this one does not. Not a fault, but
"automated" and "proven" are not the same thing.

The Synapse media are backed up and the restore is untested. synapse-backup
mounts the PVC and archives /media/media_store - the run of 21.08. held 320
files and 216 MB, which would not add up without media. The way back is
written down and explicitly not automated, and nobody has walked it.

The homelab item is dropped rather than carried anywhere: the homelab is
not part of this project, and it should not have been listed as remaining
work in the first place.

Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01F2Q4Ri8NGwyTZzScvKnWFM
This commit is contained in:
Thore Cimbal
2026-08-21 12:00:00 +00:00
co-authored by Claude Opus 5
parent dc9ed418cf
commit eb55bc4e4b
2 changed files with 44 additions and 5 deletions
+3 -4
View File
@@ -2,18 +2,17 @@
<!-- Generated by scripts/gen_status.py — do not edit. -->
## Issues (52 open, 47 closed)
## Issues (51 open, 48 closed)
Verteilung: M1 6 · M2 16 · M3 4 · M4 11 · M5 15
Verteilung: M1 5 · M2 16 · M3 4 · M4 11 · M5 15
Bedeutung der Meilensteine: siehe [roadmap.md](roadmap.md).
### M1 (6)
### M1 (5)
| Issue | Priorität | Status | Title |
|---|---|---|---|
| [0056](docs/issues/0056-gitops-9-external-postgresql-migration-cloudnativepg-o.md) | high | open | External PostgreSQL Migration: CloudNativePG or Hetzner |
| [0030](docs/issues/0030-der-restore-ist-nie-geprobt-sicherungen-sind.md) | medium | in-progress | Der Restore ist nie geprobt — Sicherungen sind bisher eine Vermutung |
| [0078](docs/issues/0078-gitops-45-cve-meldeweg-v2-metriken-grafana-dashboard-al.md) | medium | open | CVE-Meldeweg v2: Metriken, Grafana-Dashboard, Alerts in eigenen Matrix-Raum |
| [0088](docs/issues/0088-gitops-56-networkpolicy-ausgehender-verkehr-ist-unbesch.md) | medium | open | NetworkPolicy: 15 Arbeitslasten haben noch freien Ausgang, zwei Namespaces ganz |
| [0004](docs/issues/0004-overmind-02-e1000e-nic-hang-beobachtung-nach.md) | low | waiting | OVERMIND-02: e1000e-NIC-Hang — Beobachtung nach EEE-Fix + Firmware-Update |
@@ -1,7 +1,7 @@
---
type: issue
id: "0030"
status: in-progress
status: done
created: 2026-08-06
milestone: M1
priority: medium
@@ -305,3 +305,43 @@ sagt, hätte ein ausbleibendes Signal als bekannt-und-erwartet erscheinen lassen
Entscheidung, kein Handgriff; gehört fachlich zu #0025/CVE-Pipeline.
- **Phase A/B des Restore-Verfahrens** (Wiederanlauf auf leerem Host, Synapse-Medien) —
unverändert offen, braucht eine Wegwerf-Umgebung.
## Geschlossen 2026-08-21 (Entscheidung sorb)
Der Gegenstand dieses Issues war die Frage im Titel: **Sind die Sicherungen eine
Vermutung?** Sie ist seit dem 2026-08-14 beantwortet — mit zurückgespielten Zeilen, nicht
mit einer Zusage. Der Titel war seither sachlich falsch und ist eine Woche lang stehen
geblieben; das Issue stand ebenso lange auf `in-progress`, ohne dass daran gearbeitet
wurde. Dieselbe Fehlerklasse wie bei #0083 und #0088, am selben Tag zum dritten Mal.
**Belegt und abgeschlossen:**
- Datenbank-Restore geprobt (synapse 31.908, MAS 16.085, authentik 325.149, wiki 251),
wiederholbar über `notfall.sh` Stufe 3 in eine Wegwerf-Postgres im Pod.
- Verfahren und Werkzeug liegen im eigenen Repo `notfallhandbuch`; ADR-0016 hält die
bewusste Ausnahme von der Spiegel-Topologie fest.
- Monatlicher CronJob `restore-drill` eingerichtet, Alarmkette am 2026-08-15 durchgängig
verifiziert.
⚠️ **Zwei Dinge, die beim Schließen nachgemessen wurden und nicht im Text standen:**
1. **`restore-drill` hat planmäßig noch nie gefeuert.** `kubectl get cronjob` zeigt
`lastScheduleTime: <none>`; der Job wurde am 14.08. angelegt und läuft am 4. des
Monats, der erste automatische Lauf ist also der **2026-09-04**. Bestanden hat bisher
nur der manuelle Lauf. Alle anderen CronJobs im Cluster zeigen frische Zeitstempel,
dieser als einziger nicht. Kein Fehler — aber die Automatisierung ist eingerichtet und
unbewiesen, und das ist nicht dasselbe.
2. **Die Synapse-Medien sind gesichert, der Rückweg ist ungeprobt.** `synapse-backup`
mountet das PVC und archiviert `/media/media_store`; der Lauf vom 2026-08-21 enthielt
320 Dateien und 216,14 MB, was ohne Medien nicht zustande käme. Der Restore steht in
`restore-matrix.md` und ist dort ausdrücklich **nicht** automatisiert — ausgeführt hat
ihn niemand.
**Was aus dem Restaufwand wird:**
- **Phase A/B** (Wiederanlauf auf leerem Host: K3s, zwei Bootstrap-Secrets, Flux) und der
**Medien-Restore** bleiben offen. Beides hängt an einer Wegwerf-Umgebung und ist damit
ein eigenes Vorhaben, kein Nachtrag zu einer Datenbank-Probe.
- ⚠️ Die **Homelab-Seite** (GitLab/Overmind → MinIO/DSM) entfällt ersatzlos: Das Homelab
ist **nicht Teil dieses Projekts** (Entscheidung sorb, 2026-08-21). Der Punkt stand hier
irrtümlich und wird nicht anderswohin übertragen.