Diagnose
Inhaltsverzeichnis
- Überblick
- Bildschirmaufbau
- Suchbereich oben
- Timeline
- Links — Tabelle der Diagnoseprotokolle
- Statistikpanels rechts (3 Stück)
- Gesamtexport (CSV)
- Standardvorgehen zur Diagnose im Störungsfall
- Häufige Muster von Diagnosemeldungen
- Häufige Fragen
- Verwandte Bildschirme
Überblick
Der Diagnosebildschirm zeigt alle innerhalb der Platform aufgetretenen Diagnoseereignisse (Information, Warnung, Kritisch) gleichzeitig aus drei Perspektiven: als chronologische Timeline, als Tabelle und als Statistikdiagramme. Für Systemadministratoren und Betreiber ist dies der erste Bildschirm bei der Ursachenanalyse einer Störung.
Dieser Bildschirm fasst die folgenden Funktionen zusammen:
- Timeline — auf einen Blick erkennen, wann was passiert ist
- Protokolltabelle — exakter Zeitpunkt, Anwendung, Level und Meldungsinhalt
- Statistikpanels — Levelverteilung, Verteilung nach Tageszeit, Verteilung nach Anwendung
Pfad: Linkes Menü > System > Diagnose (interne URL /diagnostic/index)
Bildschirmaufbau
┌───────────────────────────────────────────────────────────────────────────────┐
│ 🩺 진단 │
│ [기간] [애플리케이션] [레벨] [건수] [조회] [전체 출력] [↻] │ ← ① 검색 영역
├───────────────────────────────────────────────────────────────────────────────┤
│ 타임라인 + 빠른 시간 범위 │ ← ② 타임라인
├──────────────────────────────────────────────────────────┬────────────────────┤
│ │ 🥧 통계 │
│ 진단 로그 테이블 │ 검색된 진단 N건 │
│ 애플리케이션 │ 레벨 │ 시간 │ 메세지 │ 정보·경고·심각 뱃지│ ← ③
│ ... │ 레벨 비율 차트 │
│ ├────────────────────┤
│ │ 📊 시간별 발생 추이 │
│ ├────────────────────┤
│ │ 🖥 애플리케이션별 │
│ │ 분포 │
└──────────────────────────────────────────────────────────┴────────────────────┘
| Bereich | Position | Anzeige |
|---|---|---|
| ① Suchbereich | Formular oben rechts | Zeitraum, Anwendung, Level, Anzahl + Abfragen/Gesamtexport/Aktualisieren |
| ② Timeline | Volle Breite | Diagnosemarker auf dem Zeitstrahl + 6 Schaltflächen für schnelle Zeitbereiche |
| ③ Links | col-lg-8 | Tabelle der Diagnoseprotokolle (feste 4 Spalten) |
| ③ Rechts | col-lg-4 | 3 Statistikpanels (Levelverteilung, Zeitverlauf, Verteilung nach Anwendung) |
Suchbereich oben
Das Suchformular oben rechts auf der Seite ist einzeilig angeordnet und enthält von links nach rechts die folgenden Bedienelemente.
Eingabefelder und Schaltflächen
| Bedienelement | Breite | Form | Standardwert/Optionen | Beschreibung |
|---|---|---|---|---|
Zeitraum (search_time) | 280px | Texteingabe (zentriert, fett) | leer | Beim Anklicken öffnet sich die Auswahl für Datums- und Zeitbereich, um Start-/Endzeitpunkt festzulegen. Innerhalb des Formulars wird der Wert über die Hidden-Felder search_date_from / search_date_to übergeben |
Anwendung (app_name) | 120px | Dropdown | Server (SERVER), Agent (AGENT), Batch (BATCH), Edge Gateway (EDGE) | Modul, das die Diagnose ausgegeben hat |
Level (level) | 100px | Dropdown | Alle Level, Information (INFO), Warnung (WARN), Kritisch (ERROR) | Filter für das Diagnoselevel. Bei leerem Wert alle |
Meldungssuche (message) | 250px (ausgeblendet) | Texteingabe | leer | Stichwortsuche im Meldungstext. Standardmäßig ausgeblendet, je nach Betriebsumgebung eingeblendet |
Anzahl (limit) | 130px | Dropdown | 100, 200, 300, 500, 1.000 | Anzahl der anzuzeigenden jüngsten Diagnoseeinträge |
| Abfragen | (automatisch) | Rote Schaltfläche + 🔍 | — | Diagnosedaten mit den obigen Bedingungen abfragen |
| Gesamtexport | (automatisch) | Rote Schaltfläche + 📄 | — | Diagnoseergebnisse der aktuellen Bedingungen gesammelt als CSV-Datei herunterladen |
Aktualisieren (realtime_icon) | (automatisch) | Rote Schaltfläche + ↻ | — | Erneute Abfrage mit unveränderten Bedingungen — als Dashboard nutzbar |
Bedeutung des Dropdowns „Anwendung"
| Wert | Bezeichnung | Beschreibung |
|---|---|---|
SERVER | Server | Webserver, Verwaltungskonsole, Domänendienste |
AGENT | Agent | Agent zur Datenerfassung (Pipeline) |
BATCH | Batch | Batch-Verarbeitung, Aggregation, Berichtserstellung |
EDGE | Edge Gateway | Edge-Gerät (Vor-Ort installiertes Gateway) |
Bedeutung des Dropdowns „Level"
| Wert | Bezeichnung | Farbe | Bedeutung | Empfohlene Maßnahme |
|---|---|---|---|---|
| `` (leerer Wert) | Alle Level | — | Alle Level | |
INFO | Information | Blau | Informationen zum Normalbetrieb, Start-/Stopp-Meldungen usw. | Keine Maßnahme erforderlich |
WARN | Warnung | Orange | Potenzielle Probleme, Überschreiten weicher Schwellwerte | Verlauf prüfen, andere Module im selben Zeitraum kontrollieren |
ERROR | Kritisch | Rot | Fehler, Funktionsstörungen, Ausnahmen | Sofortige Ursachenanalyse + Systemadministrator |
Timeline
Im Panel unterhalb des Suchbereichs wird die Diagnose-Timeline gezeichnet.
| Element | Beschreibung |
|---|---|
| Kopfzeile | 🕐 „Timeline" + rechts in kleiner Schrift die Zusammenfassung der Suchergebnisse (result_txt) |
| Timeline-Inhalt | alarm_timeline — horizontale Zeitachse, Diagnoseeinträge als farbige Marker |
| Markerfarben | Information=Blau, Warnung=Orange, Kritisch=Rot |
| Hover | Beim Überfahren eines Markers erscheint ein Tooltip mit Zeitpunkt und Meldungsvorschau |
| Klick | Die zugehörige Zeile wird in der linken Tabelle automatisch hervorgehoben |
Schnelle Zeitbereiche (Timeline range)
Über die 6 Schaltflächen rechts in der Timeline-Kopfzeile lässt sich sofort zoomen.
| Schaltfläche | data-range | Funktion |
|---|---|---|
| 10 Min zurück | 10M | Zoom auf die letzten 10 Minuten |
| 30 Min zurück | 30M | Zoom auf die letzten 30 Minuten |
| 1 Std zurück | 1H | Zoom auf die letzte Stunde |
| 6 Std zurück | 6H | Zoom auf die letzten 6 Stunden |
| 12 Std zurück | 12H | Zoom auf die letzten 12 Stunden |
| Gesamter Zeitraum | ALL | Gesamter Suchzeitraum (standardmäßig aktiv) |
Die Schaltflächen für schnelle Zeitbereiche zoomen lediglich in die bereits abgefragten Ergebnisse hinein. Für längere Zeiträume muss über das Feld Zeitraum im Suchbereich neu abgefragt werden.
Links — Tabelle der Diagnoseprotokolle
| 애플리케이션 | 레벨 | 시간 | 메세지 |
|-------------|------|------------------|--------------------------------------|
| server | ERROR| 2026-05-08 12:00 | Connection timeout to upstream... |
| messaging | WARN | 2026-05-08 11:55 | Buffer overflow threshold reached... |
| Spalte | Breite | Ausrichtung | Anzeige |
|---|---|---|---|
| Anwendung | 140px | Zentriert | Name des Moduls, das die Diagnose ausgegeben hat (z. B. server, agent, batch, edge) |
| Level | 80px | Zentriert | Farbiges Badge — INFO (blau) / WARN (orange) / ERROR (rot) |
| Zeit | 160px | Zentriert | Zeitpunkt der Diagnose (yyyy-MM-dd HH:mm:ss) |
| Meldung | automatisch (Rest) | Links | Diagnosetext (da die Tabelle table-layout: fixed ist, wird der Text auf die Zellenbreite gekürzt — für den Umbruch Doppelklick auf die Zeile oder Mouse-over) |
Zeileninteraktion
- Hover: Zeilenhintergrund wird hervorgehoben
- Klick: Der zugehörige Marker in der Timeline wird synchron hervorgehoben (Synchronisation links/rechts)
- Doppelklick/Popup: Der vollständige Text sowie Zusatzinformationen wie Stack Trace werden in einem Modal angezeigt
Seitennavigation unterhalb der Tabelle
Bei großen Ergebnismengen erfolgt eine Aufteilung in Seiten. Die Zeilenanzahl pro Seite richtet sich nach dem Dropdown Anzahl im Suchbereich (100/200/300/500/1.000).
Statistikpanels rechts (3 Stück)
Statistische Visualisierung der Suchergebnisse. Alle zeigen dieselben Daten wie die linke Tabelle aus einer anderen Perspektive.
1. Statistik — Levelverteilung (diag_level_chart)
┌────────────────────────────────┐
│ 검색된 진단 : N 건 │ ← 큰 글씨 헤드라인
│ [정보 N] [경고 N] [심각 N] │ ← 3색 뱃지
│ │
│ 도넛/막대 차트 │ ← diag_level_chart (150px 높이)
└────────────────────────────────┘
| Element | ID | Anzeige |
|---|---|---|
| Überschrift | — | „Gefundene Diagnosen: N" in großer Schrift |
| Gesamtanzahl der Treffer | diag_total_count | Ganzzahl |
| Badge Information | diag_info_count | Anzahl der Einträge mit Level Information — blauer Hintergrund |
| Badge Warnung | diag_warn_count | Anzahl der Einträge mit Level Warnung — oranger Hintergrund |
| Badge Kritisch | diag_error_count | Anzahl der Einträge mit Level Kritisch — roter Hintergrund |
| Diagramm Levelverteilung | diag_level_chart | Diagramm der Verteilung von Information, Warnung, Kritisch |
| Hinweis bei leerem Zustand | diag_stats_empty | Anzeige „Keine Daten vorhanden." wenn keine Daten vorliegen |
2. Zeitlicher Verlauf des Aufkommens (diag_hourly_chart)
| Element | Beschreibung |
|---|---|
| Kopfzeile | 📊 „Zeitlicher Verlauf des Aufkommens" |
| Diagramm | Balkendiagramm nach Stunden (170px Höhe) — X-Achse Zeit, Y-Achse Anzahl der Diagnosen |
| Balkenaufteilung | Information/Warnung/Kritisch werden farblich gestapelt dargestellt |
Interpretation: Schnellt der Balken in einer Stunde plötzlich in die Höhe, gab es zu diesem Zeitpunkt eine großflächige Störung. Zeitpunkt notieren und in der linken Tabelle die Zeile dieses Zeitpunkts per Doppelklick im Detail betrachten.
3. Verteilung nach Anwendung (diag_app_chart)
| Element | Beschreibung |
|---|---|
| Kopfzeile | 🖥 „Verteilung nach Anwendung" |
| Diagramm | Donut-/Balkendiagramm (140px Höhe) — Anzahl der Diagnosen je Anwendung |
Interpretation: Entfallen auf eine Anwendung mehr als 70 % des Gesamtaufkommens, liegt vermutlich eine auf dieses Modul konzentrierte Störung vor. Über das Dropdown Anwendung im Suchbereich eingrenzen, erneut abfragen und dann die linke Tabelle prüfen.
Gesamtexport (CSV)
Mit einem Klick auf die Schaltfläche Gesamtexport im Suchbereich lassen sich alle Diagnosen der aktuellen Suchbedingungen als CSV-Datei herunterladen.
CSV-Spalten
| Spalte | Format |
|---|---|
| Anwendung | Text |
| Level | Text (INFO/WARN/ERROR) |
| Zeit | Text (yyyy-MM-dd HH:mm:ss) |
| Meldung | Text (Anführungszeichen escaped) |
Die CSV-Datei enthält nicht nur die auf dem Bildschirm sichtbaren Zeilen, sondern alle Ergebnisse, die den Suchbedingungen entsprechen. Sie ist vom Dropdown Anzahl (letzte N Einträge) unabhängig und daher für Langzeitanalysen geeignet.
Tipps zur CSV-Nutzung
- Bei Weitergabe an den Systemadministrator komprimiert (.zip) anhängen
- In externe Analysewerkzeuge (Tabellenkalkulation, BI-Tools) importieren und weitergehend nach Modul, Tageszeit und Stichwort auswerten
- Um zu prüfen, ob sich dasselbe Muster täglich wiederholt, die Daten einer Woche zusammenführen und vergleichen
Standardvorgehen zur Diagnose im Störungsfall
Bei einer Störung gehen Sie in der folgenden Reihenfolge vor, um die Ursache effizient einzugrenzen.
Schritt 1 — Zeitraum eingrenzen
- Im Feld Zeitraum den Störungszeitpunkt ±10 Minuten bis ±30 Minuten angeben
- Anzahl auf 1.000 setzen (damit nichts übersehen wird)
Schritt 2 — Zuerst nach Kritisch abfragen
- Dropdown Level auf Kritisch (ERROR) setzen → Abfragen
- Meldungen ab der ersten Zeile der linken Tabelle (jüngster ERROR) prüfen
- Im rechten Diagramm Verteilung nach Anwendung prüfen, welches Modul die meisten ERROR erzeugt hat
Schritt 3 — Warnungen im selben Zeitraum prüfen
- Level auf Warnung (WARN) umstellen und denselben Zeitraum abfragen
- WARN-Meldungen aus den 1 bis 5 Minuten vor dem ERROR prüfen — sie liefern meist den entscheidenden Hinweis
Schritt 4 — Nach Modul eingrenzen
- Die Anwendung mit den meisten ERROR/WARN im Dropdown Anwendung auswählen
- Level wieder auf Alle Level zurücksetzen und den gesamten Ablauf innerhalb des Moduls prüfen — der Zeitpunkt, an dem die INFO-Meldungen abreißen, ist ein Hinweis
Schritt 5 — Meldungsmuster
Den Meldungstext in der linken Tabelle prüfen. Unterscheiden, ob dieselbe Meldung wiederholt auftritt (Regel-Flut) oder nur einmalig auftrat (externe Zustandsänderung).
Schritt 6 — Übergabe an den Systemadministrator
Kann der Betreiber die Störungsursache nicht selbst beheben, über die Schaltfläche Gesamtexport die CSV-Datei herunterladen und dem Systemadministrator übergeben. Der Meldung sollten Sie Folgendes beilegen:
- Zeitpunkt des Störungsbeginns (Zeitpunkt des ersten ERROR)
- Auswirkungsbereich (welcher Standort/welches Modul)
- Text von 1 bis 3 ERROR-Meldungen
- CSV-Datei
Häufige Muster von Diagnosemeldungen
| Schlüsselwort der Meldung | Bedeutung | Übliche Maßnahme |
|---|---|---|
Connection timeout | Zeitüberschreitung bei der Verbindung zu einem externen Dienst | Netzwerkzustand und Verfügbarkeit des Zieldienstes prüfen |
Out of memory / OOM | Speichermangel | Systemressourcen prüfen, Neustart erwägen (Systemadministrator) |
Disk space low | Zu wenig freier Speicherplatz | Alte Daten bereinigen oder Speicher erweitern |
Authentication failed | Authentifizierung fehlgeschlagen | Token- und Kontodaten auf Ablauf/Fehler prüfen |
Buffer overflow | Verarbeitungswarteschlange voll | Last durch Vorfilterung der Trigger oder Drosselung der externen IO glätten |
Job already running | Doppelte Job-Ausführung | Vorheriger Job nicht abgeschlossen — Prüfung durch Systemadministrator |
Failed to parse | Parsen der Meldung fehlgeschlagen | Payload-Format des externen Systems prüfen |
Schema mismatch | Schema von DB/Meldung stimmt nicht überein | Prüfung durch Systemadministrator (kann direkt nach einem Deployment auftreten) |
Pipeline exception | Ausnahme in der Datenpipeline | Zusammen mit den Detaildiagrammen des gewählten Tages in der Tagesstatistik prüfen |
Edge disconnect | Edge-Gerät getrennt | Zustand je Gerät in der Verbindungsverwaltung prüfen |
Häufige Fragen
F. Das Eingabefeld für die Meldungssuche (Stichwort) wird nicht angezeigt.
A. Je nach Konfiguration der Betriebsumgebung kann die Suche im Meldungstext deaktiviert sein (display:none). Wenden Sie sich an den Systemadministrator, wenn sie aktiviert werden soll.
F. Wie lange werden Diagnosedaten aufbewahrt?
A. Standardmäßig 7 Tage. Ist eine längere Aufbewahrung nötig, können Sie die Daten per Gesamtexport als CSV in ein externes System laden oder über den Diagnose-Trigger (flow_on_diagnostic) im Flow automatisch an ein externes Logsystem übergeben.
F. Es haben sich sehr viele ERROR angesammelt, aber alle mit derselben Meldung. Kann ich das ignorieren? A. Wenn sich derselbe ERROR in kurzer Zeit wiederholt, ist eine einzelne Ursache ausgeufert; die Anzahl allein hat wenig Aussagekraft. Betrachten Sie zunächst den Zeitpunkt des ersten Auftretens und die Meldung selbst.
F. Lässt sich die Schaltfläche „Aktualisieren" auf automatische Aktualisierung umstellen? A. Der Bildschirm arbeitet ausschließlich mit expliziter Aktualisierung. Wird für die Betriebsüberwachung eine automatische Aktualisierung benötigt, klicken Sie in kurzen Abständen auf Aktualisieren oder richten Sie über die Benachrichtigungsautomatisierung im Flow einen Push bei Auftreten eines ERROR ein.
F. Die Markerfarben in der Timeline liegen zu dicht beieinander. A. Setzen Sie das Dropdown Anzahl auf einen kleineren Wert (100–200) oder grenzen Sie Level auf ERROR/WARN ein; das verbessert die Lesbarkeit.
F. Alle Module haben zum selben Zeitpunkt ERROR ausgegeben. A. Sehr wahrscheinlich liegt eine Störung der gemeinsamen Infrastruktur (Nachrichtenkanal, Speicher) vor. Prüfen Sie zusätzlich den Zustand von Infrastruktur und Engine in der Health Rail des Dashboards.
F. Der CSV-Download dauert sehr lange. A. Vermutlich sind die Suchbedingungen zu weit gefasst. Reduzieren Sie den Zeitraum auf höchstens 24 Stunden oder grenzen Sie auf ein Modul ein.
Verwandte Bildschirme
- Dashboard — Vorschau der jüngsten Diagnosen in der Health Rail rechts
- Tagesstatistik — Trends der Systemdiagnose sowie Verteilung von Ausnahmetypen/-codes
- Alarm — Historie der Domänen-Alarme
- Verbindungsverwaltung — Zustand der Edge-/OPC-Geräte
- Flow — automatisches Routing von Diagnosen über den Trigger
flow_on_diagnostic