メインコンテンツまでスキップ

運用シナリオ (ランブック)

頻繁に発生する 運用手順全体 をそのまま実行できるようまとめたランブックです。各節を上から下へそのままコピー / 実行すれば完了します。

コンテナモードボックスのランブック

systemctl is-active plantpulse-edge.serviceactive の場合はコンテナモードです。本ページの代わりに ボックス内の /opt/kopens/install/RUNBOOK.md (または コンテナモード運用ガイド) を 参照してください。RUNBOOK は 5 つの障害シナリオマトリクス (A~E) + OTA workflow + パスワード表 + コマンド cheat sheet を単一ドキュメントにまとめています。

本ページは native ボックスのシナリオです。


1. 新バージョン配布 — 最も安全な手順

# 0. 작업 공지 (관제 / Slack)
echo "[$(date +%F\ %T)] 게이트웨이 업그레이드 시작 — 약 15분 소요"

# 1. 사전 백업 (자동 backup 도 있지만 수동으로 한 번 더)
$PE_HOME/bin/backup.sh

# 2. 외부 NAS / S3 로 즉시 미러
LATEST=$(ls -t /data1/pp-backup | head -1)
rsync -av /data1/pp-backup/$LATEST nas:/backup/edge/

# 3. 업그레이드 (자동으로 backup → install → start)
$PE_HOME/bin/upgrade.sh

# 4. 검증
$PE_HOME/bin/ps.sh
curl -s http://127.0.0.1/api/v1/edge | jq # 버전 확인
curl -s http://127.0.0.1/ui/opcua/tree | jq '.data.tree | length' # 사이트/태그 정상
$PE_HOME/bin/log-viewer.sh # 30초 정도 봐서 SEVERE 없는지
# (Ctrl+C)

# 5. 외부 SCADA / Sparkplug 수신측 정상 도착 여부 확인
echo "[$(date +%F\ %T)] 업그레이드 완료"

詳細: アップグレード (upgrade.sh), バックアップ (backup.sh)


2. 反応が重いとき の高速再起動

$PE_HOME/bin/restart.sh
# 6초 후
curl -s http://127.0.0.1/api/v1/edge | jq

コード/設定の反映も同時に完了します。Cassandra/HiveMQ/Node-RED は無停止

詳細: 再起動 (restart.sh)


3. 障害診断 — 段階的に

# 1. 누가 죽었나?
$PE_HOME/bin/ps.sh

# 2. 어디가 시끄러운가?
$PE_HOME/bin/log-viewer.sh
# (실시간 — Ctrl+C 로 빠져나옴)

# 3. Cassandra 의심
$PE_HOME/bin/node-info.sh

# 4. Disk 의심
df -h /data1
du -sh $PE_HOME/*/log/* /data1/* 2>/dev/null | sort -h | tail -20

# 5. 다 안 맞으면 — 안전하게 단계적 재시작
$PE_HOME/bin/restart.sh # 1차: Tomcat 만
# 그래도 이상 시
$PE_HOME/bin/stop.sh
$PE_HOME/bin/start.sh # 2차: 전체
# 그래도 이상 시
sudo $PE_HOME/bin/reboot.sh # 3차: OS 재부팅 (최후의 수단)

詳細: 診断 / 点検


4. ディスク不足への対応

# 1. 무엇이 차지 중?
df -h
du -sh $PE_HOME/*/log/* /data1/* 2>/dev/null | sort -h | tail -20

# 2. 로그 / 임시 파일 정리
$PE_HOME/bin/clean.sh

# 3. Cassandra 디스크 회수
$PE_HOME/bin/node-cleanup.sh

# 4. 오래된 백업 정리 (30 일 이상)
find /data1/pp-backup -maxdepth 1 -type d -mtime +30 -exec rm -rf {} +

# 5. 결과 확인
df -h

詳細: 整理 / クリーンアップ


5. 定期バックアップの自動化 (cron 例)

# /etc/cron.d/plantpulse-backup
# 매일 새벽 1시에 백업, 30일 이상은 자동 삭제
0 1 * * * root /opt/kopens/plantpulse-edge/bin/backup.sh >>/var/log/pp-backup.log 2>&1
30 1 * * * root find /data1/pp-backup -maxdepth 1 -type d -mtime +30 -exec rm -rf {} +

cron 適用後、翌日午前 1 時に /data1/pp-backup/<date>/ が新しく生成されるか確認してください。

詳細: バックアップ (backup.sh)


6. OS セキュリティパッチ (四半期ごと)

# 1. 사전 백업
$PE_HOME/bin/backup.sh

# 2. 게이트웨이 정지 (커널 업데이트 가능성 대비)
$PE_HOME/bin/stop.sh

# 3. OS 업데이트
$PE_HOME/bin/firmware.sh

# 4. 커널 업데이트 시 재부팅 필요
needs-restarting -r
# 결과가 "Reboot is required" 이면
$PE_HOME/bin/reboot.sh
# 부팅 후 ssh 다시 들어가서
$PE_HOME/bin/start.sh

# 5. 검증
$PE_HOME/bin/ps.sh

詳細: アップグレード (upgrade.sh / firmware.sh)


7. 停電 / OS 再起動後

systemd への登録により自動起動する場合もありますが、手動で点検します:

$PE_HOME/bin/ps.sh
# 출력이 비어있거나 일부만 살아있다면
$PE_HOME/bin/start.sh
# 또는 백그라운드로
$PE_HOME/bin/start-daemon.sh

詳細: 起動 (start.sh)


8. バックアップからの復旧 (災害復旧)

復旧はデータの上書き — 経験者と一緒に

以下は 全体復元 の全体像です。運用環境でそのままコピー実行せず、運用チームと共に 実施してください。

詳細手順: バックアップ (backup.sh) — バックアップからの復旧


9. さらに詳しく

  • 各スクリプトの詳細は左メニュー: 起動 / 停止 / 再起動 / バックアップ / アップグレード / 診断 / 整理
  • 全スクリプトを一覧で確認: 一覧で見る