Backup / Wiederherstellung
Container-Modus (2026.05+, empfohlen)
sudo bash /opt/kopens/install/bin/backup.sh
# 산출: /data1/pp-backups/pe-backup-<ts>.tar.zst + .sha256
# 포함: cassandra (drain 후), redis (AOF), hivemq, node-userdir, /etc/kopens
OTA upgrade.sh erstellt mit demselben Werkzeug automatisch einen Pre-Snapshot (zur Datenwiederherstellung beim Rollback).
Wiederherstellung:
sudo bash /opt/kopens/install/bin/restore.sh /data1/pp-backups/pe-backup-20260517-153000.tar.zst
Auch der aktuelle Zustand wird automatisch als pre-restore-*.tar.zst gesichert → Wiederherstellung → Container startet automatisch neu. sha256 wird automatisch verifiziert.
Periodisches Backup (cron):
echo "0 3 * * * root /opt/kopens/install/bin/backup.sh > /dev/null 2>&1" \
> /etc/cron.d/plantpulse-edge-backup
echo "0 4 * * 0 root find /data1/pp-backups -name 'pe-backup-*.tar.zst' -mtime +30 -delete" \
>> /etc/cron.d/plantpulse-edge-backup
Ausführliche Anleitung: Betriebsleitfaden Container-Modus.
(legacy) Native-Modus
$PE_HOME/bin/backup.sh
Speicherort (<DT> = YYYYMMDD-HHMMSS):
/data1/pp-backup/<DT>/
├── env.sh # 환경 변수 스냅샷
├── app.properties # 게이트웨이 설정 사본
├── cassandra/ # nodetool snapshot — sstable 그대로 (TTL/메타 보존)
│ ├── pe/ # keyspace
│ └── system_*/
├── sparkplugb/ # bdSeq 등 sparkplug 상태
├── grafana/ # 대시보드 / 데이터소스 정의
├── node-red/ # Node-RED userDir (플로우 / credentials / 패키지)
├── hivemq/ # MQTT persistence
└── apm/
Normale Ausgabe:
[1] DUMP env.sh / app.properties ... OK
[2] CASSANDRA nodetool snapshot ... OK (snapshot=backup-20260508-040215, size=1.2 GB)
[3] COPY /data1/pp-data/{sparkplugb,grafana,node-red,hivemq,apm} ... OK
BACKUP COMPLETED — /data1/pp-backup/20260508-040215/ (총 2.1 GB, 소요 47s)
Die Dauer ist proportional zur Datenmenge (üblicherweise im Minutenbereich).
2. Nach Abschluss des Backups — unbedingt auf externe Medien
Liegt /data1/pp-backup/ auf derselben physischen Festplatte wie das Gateway, gibt es keinen Effekt für die Disaster Recovery. Eine Spiegelung auf ein externes NAS / S3 / einen anderen Server ist zwingend erforderlich.
# 마지막 백업 디렉토리 이름
LATEST=$(ls -t /data1/pp-backup | head -1)
# 외부 NAS / S3 / 다른 서버로 미러
rsync -av /data1/pp-backup/$LATEST nas:/backup/edge/
3. Regelmäßige Automatisierung (cron-Beispiel)
# /etc/cron.d/plantpulse-backup
# 매일 새벽 1시에 백업, 30일 이상은 자동 삭제
0 1 * * * root /opt/kopens/plantpulse-edge/bin/backup.sh >>/var/log/pp-backup.log 2>&1
30 1 * * * root find /data1/pp-backup -maxdepth 1 -type d -mtime +30 -exec rm -rf {} +
Prüfen Sie nach dem Einrichten von cron am nächsten Tag um 1 Uhr nachts, ob /data1/pp-backup/<date>/ neu angelegt wird.
Am sichersten ist es, am Ende der 0 1 * * *-Zeile in cron ein && rsync ... anzuhängen, damit direkt nach dem Backup automatisch nach extern gespiegelt wird.
4. Wiederherstellung aus einem Backup (Disaster Recovery — Grundablauf)
Nachfolgend das Gesamtbild einer vollständigen Wiederherstellung. Kopieren und führen Sie dies nicht unbesehen in der Produktivumgebung aus, sondern gehen Sie gemeinsam mit dem Betriebsteam vor.
# 1. 게이트웨이 정지
$PE_HOME/bin/stop.sh
# 2. 복원 대상 백업 디렉토리 결정
LATEST=/data1/pp-backup/<YYYYMMDD-HHMMSS>
# 3. 설정 복구
cp $LATEST/app.properties $PE_HOME/server/webapps/plantpulse-edge-web/WEB-INF/classes/
# 4. 도구 데이터 복구
rsync -av --delete $LATEST/sparkplugb/ /data1/pp-data/sparkplugb/
rsync -av --delete $LATEST/grafana/ /data1/pp-data/grafana/
rsync -av --delete $LATEST/node-red/ /data1/pp-data/node-red/
rsync -av --delete $LATEST/hivemq/ /data1/pp-data/hivemq/
# 5. Cassandra 복구 (snapshot sstable 복사 → restart)
# 상세 절차는 Cassandra 운영 문서 / Apache 가이드 참조
# (단순화하면: $LATEST/cassandra/<keyspace>/<table>/snapshot/<id>/ 의 sstable 들을
# 실제 data 디렉토리로 cp 하고 nodetool refresh)
# 6. 게이트웨이 시작
$PE_HOME/bin/start.sh
# 7. 검증
$PE_HOME/bin/ps.sh
curl -s http://127.0.0.1/ui/opcua/tree | jq '.data.tree | length'
5. Häufige Stolperfallen
| Symptom | Ursache / Abhilfe |
|---|---|
backup.sh überschreibt jedes Mal dasselbe Verzeichnis | (nicht normal) Format von BUILD_DATE geändert / Uhrzeit fehlerhaft. Ergebnis von date + Zeilen in backup.sh prüfen |
| Hängt beim Schritt Cassandra-Snapshot | I/O / zu wenig Speicherplatz. df -h /data1 |
| Größe des Backup-Verzeichnisses unplausibel (einige KB) | Einzelne Schritte fehlgeschlagen. Ausgabelog prüfen |
6. Weiterführende Informationen
- Das Upgrade ruft das Backup automatisch auf → Upgrade (
upgrade.sh) - Bereinigung / Speicherplatz freigeben → Bereinigung / Aufräumen
- Betriebsszenarien — Ablauf beim Ausrollen einer neuen Version → Betriebsszenarien