docs: close #0030 — the question in its title was answered a week ago
The subject of the issue was whether the backups were a guess. That was settled on 14.08. with restored row counts rather than an assurance, and the title has been wrong ever since. It also sat at in-progress for a week without work. Third issue today with the same stale-head class. Two things measured while closing, neither of them in the text: restore-drill has never fired on schedule. lastScheduleTime is none - the job was created on 14.08. and runs on the 4th, so the first automatic run is 04.09. Only the manual run has passed. Every other cronjob in the cluster shows a fresh timestamp; this one does not. Not a fault, but "automated" and "proven" are not the same thing. The Synapse media are backed up and the restore is untested. synapse-backup mounts the PVC and archives /media/media_store - the run of 21.08. held 320 files and 216 MB, which would not add up without media. The way back is written down and explicitly not automated, and nobody has walked it. The homelab item is dropped rather than carried anywhere: the homelab is not part of this project, and it should not have been listed as remaining work in the first place. Co-Authored-By: Claude Opus 5 <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01F2Q4Ri8NGwyTZzScvKnWFM
This commit is contained in:
co-authored by
Claude Opus 5
parent
dc9ed418cf
commit
eb55bc4e4b
@@ -2,18 +2,17 @@
|
||||
|
||||
<!-- Generated by scripts/gen_status.py — do not edit. -->
|
||||
|
||||
## Issues (52 open, 47 closed)
|
||||
## Issues (51 open, 48 closed)
|
||||
|
||||
Verteilung: M1 6 · M2 16 · M3 4 · M4 11 · M5 15
|
||||
Verteilung: M1 5 · M2 16 · M3 4 · M4 11 · M5 15
|
||||
|
||||
Bedeutung der Meilensteine: siehe [roadmap.md](roadmap.md).
|
||||
|
||||
### M1 (6)
|
||||
### M1 (5)
|
||||
|
||||
| Issue | Priorität | Status | Title |
|
||||
|---|---|---|---|
|
||||
| [0056](docs/issues/0056-gitops-9-external-postgresql-migration-cloudnativepg-o.md) | high | open | External PostgreSQL Migration: CloudNativePG or Hetzner |
|
||||
| [0030](docs/issues/0030-der-restore-ist-nie-geprobt-sicherungen-sind.md) | medium | in-progress | Der Restore ist nie geprobt — Sicherungen sind bisher eine Vermutung |
|
||||
| [0078](docs/issues/0078-gitops-45-cve-meldeweg-v2-metriken-grafana-dashboard-al.md) | medium | open | CVE-Meldeweg v2: Metriken, Grafana-Dashboard, Alerts in eigenen Matrix-Raum |
|
||||
| [0088](docs/issues/0088-gitops-56-networkpolicy-ausgehender-verkehr-ist-unbesch.md) | medium | open | NetworkPolicy: 15 Arbeitslasten haben noch freien Ausgang, zwei Namespaces ganz |
|
||||
| [0004](docs/issues/0004-overmind-02-e1000e-nic-hang-beobachtung-nach.md) | low | waiting | OVERMIND-02: e1000e-NIC-Hang — Beobachtung nach EEE-Fix + Firmware-Update |
|
||||
|
||||
@@ -1,7 +1,7 @@
|
||||
---
|
||||
type: issue
|
||||
id: "0030"
|
||||
status: in-progress
|
||||
status: done
|
||||
created: 2026-08-06
|
||||
milestone: M1
|
||||
priority: medium
|
||||
@@ -305,3 +305,43 @@ sagt, hätte ein ausbleibendes Signal als bekannt-und-erwartet erscheinen lassen
|
||||
Entscheidung, kein Handgriff; gehört fachlich zu #0025/CVE-Pipeline.
|
||||
- **Phase A/B des Restore-Verfahrens** (Wiederanlauf auf leerem Host, Synapse-Medien) —
|
||||
unverändert offen, braucht eine Wegwerf-Umgebung.
|
||||
|
||||
## Geschlossen 2026-08-21 (Entscheidung sorb)
|
||||
|
||||
Der Gegenstand dieses Issues war die Frage im Titel: **Sind die Sicherungen eine
|
||||
Vermutung?** Sie ist seit dem 2026-08-14 beantwortet — mit zurückgespielten Zeilen, nicht
|
||||
mit einer Zusage. Der Titel war seither sachlich falsch und ist eine Woche lang stehen
|
||||
geblieben; das Issue stand ebenso lange auf `in-progress`, ohne dass daran gearbeitet
|
||||
wurde. Dieselbe Fehlerklasse wie bei #0083 und #0088, am selben Tag zum dritten Mal.
|
||||
|
||||
**Belegt und abgeschlossen:**
|
||||
|
||||
- Datenbank-Restore geprobt (synapse 31.908, MAS 16.085, authentik 325.149, wiki 251),
|
||||
wiederholbar über `notfall.sh` Stufe 3 in eine Wegwerf-Postgres im Pod.
|
||||
- Verfahren und Werkzeug liegen im eigenen Repo `notfallhandbuch`; ADR-0016 hält die
|
||||
bewusste Ausnahme von der Spiegel-Topologie fest.
|
||||
- Monatlicher CronJob `restore-drill` eingerichtet, Alarmkette am 2026-08-15 durchgängig
|
||||
verifiziert.
|
||||
|
||||
⚠️ **Zwei Dinge, die beim Schließen nachgemessen wurden und nicht im Text standen:**
|
||||
|
||||
1. **`restore-drill` hat planmäßig noch nie gefeuert.** `kubectl get cronjob` zeigt
|
||||
`lastScheduleTime: <none>`; der Job wurde am 14.08. angelegt und läuft am 4. des
|
||||
Monats, der erste automatische Lauf ist also der **2026-09-04**. Bestanden hat bisher
|
||||
nur der manuelle Lauf. Alle anderen CronJobs im Cluster zeigen frische Zeitstempel,
|
||||
dieser als einziger nicht. Kein Fehler — aber die Automatisierung ist eingerichtet und
|
||||
unbewiesen, und das ist nicht dasselbe.
|
||||
2. **Die Synapse-Medien sind gesichert, der Rückweg ist ungeprobt.** `synapse-backup`
|
||||
mountet das PVC und archiviert `/media/media_store`; der Lauf vom 2026-08-21 enthielt
|
||||
320 Dateien und 216,14 MB, was ohne Medien nicht zustande käme. Der Restore steht in
|
||||
`restore-matrix.md` und ist dort ausdrücklich **nicht** automatisiert — ausgeführt hat
|
||||
ihn niemand.
|
||||
|
||||
**Was aus dem Restaufwand wird:**
|
||||
|
||||
- **Phase A/B** (Wiederanlauf auf leerem Host: K3s, zwei Bootstrap-Secrets, Flux) und der
|
||||
**Medien-Restore** bleiben offen. Beides hängt an einer Wegwerf-Umgebung und ist damit
|
||||
ein eigenes Vorhaben, kein Nachtrag zu einer Datenbank-Probe.
|
||||
- ⚠️ Die **Homelab-Seite** (GitLab/Overmind → MinIO/DSM) entfällt ersatzlos: Das Homelab
|
||||
ist **nicht Teil dieses Projekts** (Entscheidung sorb, 2026-08-21). Der Punkt stand hier
|
||||
irrtümlich und wird nicht anderswohin übertragen.
|
||||
|
||||
Reference in New Issue
Block a user