Zum Hauptinhalt springen

Diagnose

Inhaltsverzeichnis


Überblick

Der Diagnosebildschirm zeigt alle innerhalb der Platform aufgetretenen Diagnoseereignisse (Information, Warnung, Kritisch) gleichzeitig aus drei Perspektiven: als chronologische Timeline, als Tabelle und als Statistikdiagramme. Für Systemadministratoren und Betreiber ist dies der erste Bildschirm bei der Ursachenanalyse einer Störung.

Dieser Bildschirm fasst die folgenden Funktionen zusammen:

  • Timeline — auf einen Blick erkennen, wann was passiert ist
  • Protokolltabelle — exakter Zeitpunkt, Anwendung, Level und Meldungsinhalt
  • Statistikpanels — Levelverteilung, Verteilung nach Tageszeit, Verteilung nach Anwendung

Pfad: Linkes Menü > System > Diagnose (interne URL /diagnostic/index)


Bildschirmaufbau

┌───────────────────────────────────────────────────────────────────────────────┐
│ 🩺 진단 │
│ [기간] [애플리케이션] [레벨] [건수] [조회] [전체 출력] [↻] │ ← ① 검색 영역
├───────────────────────────────────────────────────────────────────────────────┤
│ 타임라인 + 빠른 시간 범위 │ ← ② 타임라인
├──────────────────────────────────────────────────────────┬────────────────────┤
│ │ 🥧 통계 │
│ 진단 로그 테이블 │ 검색된 진단 N건 │
│ 애플리케이션 │ 레벨 │ 시간 │ 메세지 │ 정보·경고·심각 뱃지│ ← ③
│ ... │ 레벨 비율 차트 │
│ ├────────────────────┤
│ │ 📊 시간별 발생 추이 │
│ ├────────────────────┤
│ │ 🖥 애플리케이션별 │
│ │ 분포 │
└──────────────────────────────────────────────────────────┴────────────────────┘
BereichPositionAnzeige
① SuchbereichFormular oben rechtsZeitraum, Anwendung, Level, Anzahl + Abfragen/Gesamtexport/Aktualisieren
② TimelineVolle BreiteDiagnosemarker auf dem Zeitstrahl + 6 Schaltflächen für schnelle Zeitbereiche
③ Linkscol-lg-8Tabelle der Diagnoseprotokolle (feste 4 Spalten)
③ Rechtscol-lg-43 Statistikpanels (Levelverteilung, Zeitverlauf, Verteilung nach Anwendung)

Suchbereich oben

Das Suchformular oben rechts auf der Seite ist einzeilig angeordnet und enthält von links nach rechts die folgenden Bedienelemente.

Eingabefelder und Schaltflächen

BedienelementBreiteFormStandardwert/OptionenBeschreibung
Zeitraum (search_time)280pxTexteingabe (zentriert, fett)leerBeim Anklicken öffnet sich die Auswahl für Datums- und Zeitbereich, um Start-/Endzeitpunkt festzulegen. Innerhalb des Formulars wird der Wert über die Hidden-Felder search_date_from / search_date_to übergeben
Anwendung (app_name)120pxDropdownServer (SERVER), Agent (AGENT), Batch (BATCH), Edge Gateway (EDGE)Modul, das die Diagnose ausgegeben hat
Level (level)100pxDropdownAlle Level, Information (INFO), Warnung (WARN), Kritisch (ERROR)Filter für das Diagnoselevel. Bei leerem Wert alle
Meldungssuche (message)250px (ausgeblendet)TexteingabeleerStichwortsuche im Meldungstext. Standardmäßig ausgeblendet, je nach Betriebsumgebung eingeblendet
Anzahl (limit)130pxDropdown100, 200, 300, 500, 1.000Anzahl der anzuzeigenden jüngsten Diagnoseeinträge
Abfragen(automatisch)Rote Schaltfläche + 🔍Diagnosedaten mit den obigen Bedingungen abfragen
Gesamtexport(automatisch)Rote Schaltfläche + 📄Diagnoseergebnisse der aktuellen Bedingungen gesammelt als CSV-Datei herunterladen
Aktualisieren (realtime_icon)(automatisch)Rote Schaltfläche + ↻Erneute Abfrage mit unveränderten Bedingungen — als Dashboard nutzbar

Bedeutung des Dropdowns „Anwendung"

WertBezeichnungBeschreibung
SERVERServerWebserver, Verwaltungskonsole, Domänendienste
AGENTAgentAgent zur Datenerfassung (Pipeline)
BATCHBatchBatch-Verarbeitung, Aggregation, Berichtserstellung
EDGEEdge GatewayEdge-Gerät (Vor-Ort installiertes Gateway)

Bedeutung des Dropdowns „Level"

WertBezeichnungFarbeBedeutungEmpfohlene Maßnahme
`` (leerer Wert)Alle LevelAlle Level
INFOInformationBlauInformationen zum Normalbetrieb, Start-/Stopp-Meldungen usw.Keine Maßnahme erforderlich
WARNWarnungOrangePotenzielle Probleme, Überschreiten weicher SchwellwerteVerlauf prüfen, andere Module im selben Zeitraum kontrollieren
ERRORKritischRotFehler, Funktionsstörungen, AusnahmenSofortige Ursachenanalyse + Systemadministrator

Timeline

Im Panel unterhalb des Suchbereichs wird die Diagnose-Timeline gezeichnet.

ElementBeschreibung
Kopfzeile🕐 „Timeline" + rechts in kleiner Schrift die Zusammenfassung der Suchergebnisse (result_txt)
Timeline-Inhaltalarm_timeline — horizontale Zeitachse, Diagnoseeinträge als farbige Marker
MarkerfarbenInformation=Blau, Warnung=Orange, Kritisch=Rot
HoverBeim Überfahren eines Markers erscheint ein Tooltip mit Zeitpunkt und Meldungsvorschau
KlickDie zugehörige Zeile wird in der linken Tabelle automatisch hervorgehoben

Schnelle Zeitbereiche (Timeline range)

Über die 6 Schaltflächen rechts in der Timeline-Kopfzeile lässt sich sofort zoomen.

Schaltflächedata-rangeFunktion
10 Min zurück10MZoom auf die letzten 10 Minuten
30 Min zurück30MZoom auf die letzten 30 Minuten
1 Std zurück1HZoom auf die letzte Stunde
6 Std zurück6HZoom auf die letzten 6 Stunden
12 Std zurück12HZoom auf die letzten 12 Stunden
Gesamter ZeitraumALLGesamter Suchzeitraum (standardmäßig aktiv)

Die Schaltflächen für schnelle Zeitbereiche zoomen lediglich in die bereits abgefragten Ergebnisse hinein. Für längere Zeiträume muss über das Feld Zeitraum im Suchbereich neu abgefragt werden.


| 애플리케이션 | 레벨 | 시간 | 메세지 |
|-------------|------|------------------|--------------------------------------|
| server | ERROR| 2026-05-08 12:00 | Connection timeout to upstream... |
| messaging | WARN | 2026-05-08 11:55 | Buffer overflow threshold reached... |
SpalteBreiteAusrichtungAnzeige
Anwendung140pxZentriertName des Moduls, das die Diagnose ausgegeben hat (z. B. server, agent, batch, edge)
Level80pxZentriertFarbiges Badge — INFO (blau) / WARN (orange) / ERROR (rot)
Zeit160pxZentriertZeitpunkt der Diagnose (yyyy-MM-dd HH:mm:ss)
Meldungautomatisch (Rest)LinksDiagnosetext (da die Tabelle table-layout: fixed ist, wird der Text auf die Zellenbreite gekürzt — für den Umbruch Doppelklick auf die Zeile oder Mouse-over)

Zeileninteraktion

  • Hover: Zeilenhintergrund wird hervorgehoben
  • Klick: Der zugehörige Marker in der Timeline wird synchron hervorgehoben (Synchronisation links/rechts)
  • Doppelklick/Popup: Der vollständige Text sowie Zusatzinformationen wie Stack Trace werden in einem Modal angezeigt

Seitennavigation unterhalb der Tabelle

Bei großen Ergebnismengen erfolgt eine Aufteilung in Seiten. Die Zeilenanzahl pro Seite richtet sich nach dem Dropdown Anzahl im Suchbereich (100/200/300/500/1.000).


Statistikpanels rechts (3 Stück)

Statistische Visualisierung der Suchergebnisse. Alle zeigen dieselben Daten wie die linke Tabelle aus einer anderen Perspektive.

1. Statistik — Levelverteilung (diag_level_chart)

┌────────────────────────────────┐
│ 검색된 진단 : N 건 │ ← 큰 글씨 헤드라인
│ [정보 N] [경고 N] [심각 N] │ ← 3색 뱃지
│ │
│ 도넛/막대 차트 │ ← diag_level_chart (150px 높이)
└────────────────────────────────┘
ElementIDAnzeige
Überschrift„Gefundene Diagnosen: N" in großer Schrift
Gesamtanzahl der Trefferdiag_total_countGanzzahl
Badge Informationdiag_info_countAnzahl der Einträge mit Level Information — blauer Hintergrund
Badge Warnungdiag_warn_countAnzahl der Einträge mit Level Warnung — oranger Hintergrund
Badge Kritischdiag_error_countAnzahl der Einträge mit Level Kritisch — roter Hintergrund
Diagramm Levelverteilungdiag_level_chartDiagramm der Verteilung von Information, Warnung, Kritisch
Hinweis bei leerem Zustanddiag_stats_emptyAnzeige „Keine Daten vorhanden." wenn keine Daten vorliegen

2. Zeitlicher Verlauf des Aufkommens (diag_hourly_chart)

ElementBeschreibung
Kopfzeile📊 „Zeitlicher Verlauf des Aufkommens"
DiagrammBalkendiagramm nach Stunden (170px Höhe) — X-Achse Zeit, Y-Achse Anzahl der Diagnosen
BalkenaufteilungInformation/Warnung/Kritisch werden farblich gestapelt dargestellt

Interpretation: Schnellt der Balken in einer Stunde plötzlich in die Höhe, gab es zu diesem Zeitpunkt eine großflächige Störung. Zeitpunkt notieren und in der linken Tabelle die Zeile dieses Zeitpunkts per Doppelklick im Detail betrachten.

3. Verteilung nach Anwendung (diag_app_chart)

ElementBeschreibung
Kopfzeile🖥 „Verteilung nach Anwendung"
DiagrammDonut-/Balkendiagramm (140px Höhe) — Anzahl der Diagnosen je Anwendung

Interpretation: Entfallen auf eine Anwendung mehr als 70 % des Gesamtaufkommens, liegt vermutlich eine auf dieses Modul konzentrierte Störung vor. Über das Dropdown Anwendung im Suchbereich eingrenzen, erneut abfragen und dann die linke Tabelle prüfen.


Gesamtexport (CSV)

Mit einem Klick auf die Schaltfläche Gesamtexport im Suchbereich lassen sich alle Diagnosen der aktuellen Suchbedingungen als CSV-Datei herunterladen.

CSV-Spalten

SpalteFormat
AnwendungText
LevelText (INFO/WARN/ERROR)
ZeitText (yyyy-MM-dd HH:mm:ss)
MeldungText (Anführungszeichen escaped)

Die CSV-Datei enthält nicht nur die auf dem Bildschirm sichtbaren Zeilen, sondern alle Ergebnisse, die den Suchbedingungen entsprechen. Sie ist vom Dropdown Anzahl (letzte N Einträge) unabhängig und daher für Langzeitanalysen geeignet.

Tipps zur CSV-Nutzung

  • Bei Weitergabe an den Systemadministrator komprimiert (.zip) anhängen
  • In externe Analysewerkzeuge (Tabellenkalkulation, BI-Tools) importieren und weitergehend nach Modul, Tageszeit und Stichwort auswerten
  • Um zu prüfen, ob sich dasselbe Muster täglich wiederholt, die Daten einer Woche zusammenführen und vergleichen

Standardvorgehen zur Diagnose im Störungsfall

Bei einer Störung gehen Sie in der folgenden Reihenfolge vor, um die Ursache effizient einzugrenzen.

Schritt 1 — Zeitraum eingrenzen

  • Im Feld Zeitraum den Störungszeitpunkt ±10 Minuten bis ±30 Minuten angeben
  • Anzahl auf 1.000 setzen (damit nichts übersehen wird)

Schritt 2 — Zuerst nach Kritisch abfragen

  1. Dropdown Level auf Kritisch (ERROR) setzen → Abfragen
  2. Meldungen ab der ersten Zeile der linken Tabelle (jüngster ERROR) prüfen
  3. Im rechten Diagramm Verteilung nach Anwendung prüfen, welches Modul die meisten ERROR erzeugt hat

Schritt 3 — Warnungen im selben Zeitraum prüfen

  1. Level auf Warnung (WARN) umstellen und denselben Zeitraum abfragen
  2. WARN-Meldungen aus den 1 bis 5 Minuten vor dem ERROR prüfen — sie liefern meist den entscheidenden Hinweis

Schritt 4 — Nach Modul eingrenzen

  1. Die Anwendung mit den meisten ERROR/WARN im Dropdown Anwendung auswählen
  2. Level wieder auf Alle Level zurücksetzen und den gesamten Ablauf innerhalb des Moduls prüfen — der Zeitpunkt, an dem die INFO-Meldungen abreißen, ist ein Hinweis

Schritt 5 — Meldungsmuster

Den Meldungstext in der linken Tabelle prüfen. Unterscheiden, ob dieselbe Meldung wiederholt auftritt (Regel-Flut) oder nur einmalig auftrat (externe Zustandsänderung).

Schritt 6 — Übergabe an den Systemadministrator

Kann der Betreiber die Störungsursache nicht selbst beheben, über die Schaltfläche Gesamtexport die CSV-Datei herunterladen und dem Systemadministrator übergeben. Der Meldung sollten Sie Folgendes beilegen:

  • Zeitpunkt des Störungsbeginns (Zeitpunkt des ersten ERROR)
  • Auswirkungsbereich (welcher Standort/welches Modul)
  • Text von 1 bis 3 ERROR-Meldungen
  • CSV-Datei

Häufige Muster von Diagnosemeldungen

Schlüsselwort der MeldungBedeutungÜbliche Maßnahme
Connection timeoutZeitüberschreitung bei der Verbindung zu einem externen DienstNetzwerkzustand und Verfügbarkeit des Zieldienstes prüfen
Out of memory / OOMSpeichermangelSystemressourcen prüfen, Neustart erwägen (Systemadministrator)
Disk space lowZu wenig freier SpeicherplatzAlte Daten bereinigen oder Speicher erweitern
Authentication failedAuthentifizierung fehlgeschlagenToken- und Kontodaten auf Ablauf/Fehler prüfen
Buffer overflowVerarbeitungswarteschlange vollLast durch Vorfilterung der Trigger oder Drosselung der externen IO glätten
Job already runningDoppelte Job-AusführungVorheriger Job nicht abgeschlossen — Prüfung durch Systemadministrator
Failed to parseParsen der Meldung fehlgeschlagenPayload-Format des externen Systems prüfen
Schema mismatchSchema von DB/Meldung stimmt nicht übereinPrüfung durch Systemadministrator (kann direkt nach einem Deployment auftreten)
Pipeline exceptionAusnahme in der DatenpipelineZusammen mit den Detaildiagrammen des gewählten Tages in der Tagesstatistik prüfen
Edge disconnectEdge-Gerät getrenntZustand je Gerät in der Verbindungsverwaltung prüfen

Häufige Fragen

F. Das Eingabefeld für die Meldungssuche (Stichwort) wird nicht angezeigt. A. Je nach Konfiguration der Betriebsumgebung kann die Suche im Meldungstext deaktiviert sein (display:none). Wenden Sie sich an den Systemadministrator, wenn sie aktiviert werden soll.

F. Wie lange werden Diagnosedaten aufbewahrt? A. Standardmäßig 7 Tage. Ist eine längere Aufbewahrung nötig, können Sie die Daten per Gesamtexport als CSV in ein externes System laden oder über den Diagnose-Trigger (flow_on_diagnostic) im Flow automatisch an ein externes Logsystem übergeben.

F. Es haben sich sehr viele ERROR angesammelt, aber alle mit derselben Meldung. Kann ich das ignorieren? A. Wenn sich derselbe ERROR in kurzer Zeit wiederholt, ist eine einzelne Ursache ausgeufert; die Anzahl allein hat wenig Aussagekraft. Betrachten Sie zunächst den Zeitpunkt des ersten Auftretens und die Meldung selbst.

F. Lässt sich die Schaltfläche „Aktualisieren" auf automatische Aktualisierung umstellen? A. Der Bildschirm arbeitet ausschließlich mit expliziter Aktualisierung. Wird für die Betriebsüberwachung eine automatische Aktualisierung benötigt, klicken Sie in kurzen Abständen auf Aktualisieren oder richten Sie über die Benachrichtigungsautomatisierung im Flow einen Push bei Auftreten eines ERROR ein.

F. Die Markerfarben in der Timeline liegen zu dicht beieinander. A. Setzen Sie das Dropdown Anzahl auf einen kleineren Wert (100–200) oder grenzen Sie Level auf ERROR/WARN ein; das verbessert die Lesbarkeit.

F. Alle Module haben zum selben Zeitpunkt ERROR ausgegeben. A. Sehr wahrscheinlich liegt eine Störung der gemeinsamen Infrastruktur (Nachrichtenkanal, Speicher) vor. Prüfen Sie zusätzlich den Zustand von Infrastruktur und Engine in der Health Rail des Dashboards.

F. Der CSV-Download dauert sehr lange. A. Vermutlich sind die Suchbedingungen zu weit gefasst. Reduzieren Sie den Zeitraum auf höchstens 24 Stunden oder grenzen Sie auf ein Modul ein.


Verwandte Bildschirme

  • Dashboard — Vorschau der jüngsten Diagnosen in der Health Rail rechts
  • Tagesstatistik — Trends der Systemdiagnose sowie Verteilung von Ausnahmetypen/-codes
  • Alarm — Historie der Domänen-Alarme
  • Verbindungsverwaltung — Zustand der Edge-/OPC-Geräte
  • Flow — automatisches Routing von Diagnosen über den Trigger flow_on_diagnostic