AI-Verwaltungskonsole
Der AI-Stack wird mit einer Verwaltungskonsole geliefert. Sie sehen direkt im Browser, ohne sich auf dem Server anzumelden, wie stark die GPU ausgelastet ist, ob die LLM nicht verlangsamt werden und ob die Dokumentenindexierung ordnungsgemäß läuft.
Dieses Dokument richtet sich an alle, die die Konsole zum ersten Mal öffnen. Folgen Sie zunächst dem 10-Minuten-Rundgang Schritt für Schritt durch, und suchen Sie sich dann später bei Bedarf Erklärungen zu einzelnen Bildschirmen.
Vor-Ort-Betreiber und Systemadministratoren. Die Konsole besteht überwiegend aus Ansichten — es ist kaum möglich, versehentlich etwas zu zerstören. Werte können nur an drei Stellen geändert werden: beim Hochladen und Löschen von Dokumenten sowie bei der Backfill von Merkmalen. Diese sind in dieser Dokumentation besonders gekennzeichnet.
Zugriff und Anmeldung
Die Adresse hängt von der Installationsart ab. Es gibt zwei mögliche Varianten. Bestätigen Sie bei Ihrem Administrator, welche bei Ihnen vorliegt.
| Installationsart | Adresse |
|---|---|
| Mit Domain-Namen | https://admin.<COMPANY_DOMAIN> |
| Im Intranet per IP-Adresse | http://<AI_SERVER_IP>:9080 |
Geben Sie auf dem Anmeldebildschirm Ihren Benutzernamen und Ihr Passwort ein. Der Standard-Benutzername ist admin, das Passwort wird während der Installation von Ihrem Administrator festgelegt.
Die Konsole hat keine separaten Benutzerkonten. Das Betriebsteam nutzt ein gemeinsames Konto für die Anmeldung. Es wird nicht erfasst, wer was gesehen hat — verwalten Sie das Passwort daher sorgfältig, damit es das Team nicht verlässt.
Nach 8 Stunden müssen Sie sich erneut anmelden. Die Adresse der Seite, die Sie gerade angesehen haben, wird gespeichert, sodass Sie nach der Anmeldung an der gleichen Stelle weitermachen. Wenn der Dienst neu gestartet wird, können alle Sitzungen beendet werden — siehe Sitzung wird ständig beendet.
Das Menü und die Schaltflächen der Konsole werden in Englisch angezeigt (nur die Beschreibungen der Dienstkarten auf dem Startbildschirm erscheinen auf Koreanisch). In den folgenden Erläuterungen werden die englischen Namen, die tatsächlich auf dem Bildschirm angezeigt werden, fettgedruckt dargestellt und mit der deutschen Bedeutung versehen.
10-Minuten-Rundgang
Neue Benutzer sollten diese Schritte nacheinander durchlaufen. Sie ändern nichts, sondern schauen sich nur um.
Schritt 1 — Anmelden und die Startseite anschauen
Nach der Anmeldung wird sofort Home angezeigt. Oben befindet sich eine einseitige Statusübersicht.
정상 12 주의 0 중단 0 합계 12
Diese Zahlen bilden den gesamten Gesundheitszustand des AI-Stacks ab. Wenn 중단 0 ist, können Sie erst einmal beruhigt sein. Die Zahlen werden automatisch alle 20 Sekunden aktualisiert — Sie müssen nicht aktualisieren.
Wenn Sie auf das Erweiterungszeichen rechts neben der Zusammenfassung klicken, wird eine Liste angezeigt, welche Dienste welchen Status haben. Wenn Sie die Liste einmal erweitern, bleibt sie beim nächsten Besuch erweitert.
Fahren Sie in der Liste mit der Maus über den Dienst. Ein Tooltip zeigt an, warum die gelbe Leuchte leuchtet. Der Dienst selbst läuft beispielsweise, aber die Verbindung zur Datenbank ist unterbrochen.
Schritt 2 — Dienstkarten durchschauen
Unter der Zusammenfassung sehen Sie die Dienstkarten. Jede Karte steht für einen Dienst.
- Die Rahmenfarbe und der Statuskreis zeigen, ob alles in Ordnung ist
- Durch Anklicken gelangen Sie zu dem Dienst
- Einige Karten sind nicht anklickbar — das sind interne Dienste, auf die Ihr Browser nicht direkt zugreifen kann. Stellen Sie sich vor, dass Sie nur den Status dieser Karten ansehen können
Schritt 3 — Schauen Sie sich die GPU an
Klicken Sie auf der linken vertikalen Leiste (Rail) auf GPU. GPU-Geräte werden in einer Tabelle angezeigt.
| Zu beachten | Bedeutung |
|---|---|
| Auslastung | Wie stark die GPU derzeit beansprucht wird |
| Speicher | Wie viel Speicher das Modell belegt |
| Temperatur | Höhere Temperaturen führen zu Leistungsabfall |
| XID | Anzahl der NVIDIA-Hardware- oder -Treiberfehler |
XID sind Fehler der GPU-Hardware oder des Treibers. Wenn Sie diese ignorieren, ist der nächste Schritt normalerweise ein Serverabsturz. Wenn Sie eine Zahl sehen, die nicht 0 ist, notieren Sie sie und teilen Sie sie Ihrem Systemadministrator mit.
Schritt 4 — Schauen Sie sich die LLM-Reaktionsgeschwindigkeit an
Klicken Sie auf der Leiste auf LLM. Für jedes Modell werden Reaktionsgeschwindigkeit und Durchsatz angezeigt.
Wenn jemand sagt „Die Antworten sind in letzter Zeit langsam", schauen Sie sich die P95-Spalte (die 5. langsamste von 100 Abfragen) an. Wenn sie deutlich über dem Normalwert liegt, ist das Empfinden berechtigt. Die kleine Sparkline am Ende der Zeile zeigt den neuesten Trend.
Schritt 5 — Klicken Sie auf einen Dienst
Klicken Sie auf der Leiste auf RAG API. Sein Menü wird auf der linken Seite angezeigt. Klicken Sie auf Documents (Dokumente). Es wird eine Liste der indizierten Dokumente angezeigt.
Klicken Sie hier auf nichts — schauen Sie sich nur an, wie viele Dokumente indexiert sind. Wenn der Chatbot antwortet „Ich konnte keine relevanten Dokumente finden", ist dies der erste Ort zum Überprüfen.
Schritt 6 — Protokolle anschauen
Klicken Sie im gleichen Dienstmenü auf Logs (Protokolle). Die neuesten Protokolle werden in neuester Reihenfolge (neueste oben) angezeigt. Sie müssen nicht auf den Server via SSH gehen und docker logs eingeben.
Schritt 7 — Das war's
Sie haben jetzt 90 % der Arbeit mit der Konsole gesehen. Zusammenfassung:
Sehen Sie auf der Startseite den Gesamtstatus an → gehen Sie zu dem Dienst mit Problemen → schauen Sie sich die Protokolle an.
Andere Bildschirme finden Sie später bei Bedarf in der folgenden Dokumentation.
Bildschirmübersicht
Linke Leiste (immer sichtbar)
| Menü | Funktion |
|---|---|
| Home | Gesamtstatuszusammenfassung + Dienstkarten |
| GPU | GPU-Geräte mit Auslastung, Speicher, Temperatur, XID |
| LLM | Modelle mit Reaktionsgeschwindigkeit und Durchsatz |
| RAG API | Dokumentensuch-Engine — Indizierung, Synchronisierung, Suchtests |
| Timeseries Insight | Anlage-Anomalieerkennung und Vorhersage-Engine |
| Document Parsing | Service zum Extrahieren von Tabellen und Feldern aus Dokumenten |
| Vision | Bildverarbeitungs-Service (Mängelbestimmung, Instrumentenablesung) |
| Operations Manual ↗ | Diese Dokumentation (neues Fenster) |
GPU und LLM stehen absichtlich über den Diensten. Leistungsprobleme oder Ausfälle beginnen normalerweise in der darunter liegenden Infrastruktur. Die Reihenfolge von oben nach unten hilft, Probleme schneller zu finden.
Operations Manual verweist auf eine externe Website (docs.plantpulse.io). Im Betrieb ohne Internetverbindung öffnet sich die Seite nicht. Das Handbuch wird als Kopie auf dem Server installiert — wenden Sie sich an Ihren Administrator.
Vier Dienste mit identischen Menüs
RAG API · Timeseries Insight · Document Parsing · Vision haben gleich die folgenden vier Menüs. Wenn Sie es einmal verstehen, funktioniert es überall gleich.
| Menü | Funktion |
|---|---|
| MCP Server Info | Liste der Tools, die dieser Service dem AI-Copilot bereitstellt |
| API Endpoints | Liste der verfügbaren APIs dieses Service (für Integrationsentwickler) |
| Logs | Neueste Protokolle (neueste oben) |
| Settings | Aktuell verwendete Konfigurationswerte — schreibgeschützt |
Sie zeigt nur Werte an, kann diese aber nicht ändern. Passwörter und API-Schlüssel werden maskiert angezeigt. Um die Einstellungen wirklich zu ändern, siehe Passwort und API-Schlüssel ändern und Service-Betrieb.
RAG API — Dokumentensuche
Dieser Service ermöglicht es Chatbots, Antworten auf Basis von unternehmensinternen Dokumenten zu geben. Wenn ein Chatbot Dokumente nicht finden kann, beginnen Sie hier.
| Menü | Funktion |
|---|---|
| Documents | Liste der indizierten Dokumente. Hochladen und Löschen möglich |
| Sync History | Zeigt, wann die Synchronisierung zuletzt durchgeführt wurde und ob sie erfolgreich war |
| Query Test | Geben Sie einen Suchbegriff ein und sehen Sie direkt, welche Ergebnisse zurückgegeben werden |
| 4 gemeinsame | siehe Tabelle oben |
Wenn der Chatbot Dokumente nicht finden kann
- Schauen Sie unter Documents nach, ob das Dokument in der Liste vorhanden ist — wenn nicht, wurde es nicht indiziert
- Wenn es vorhanden ist, verwenden Sie Query Test und suchen Sie mit ähnlichen Begriffen wie die Benutzer
- Wenn auch hier nichts gefunden wird, versuchen Sie eine andere Suchmethode — Sie können zwischen
hybrid·local·global·naive·mixwählen. Die Standardmethode isthybrid - Überprüfen Sie unter Sync History, ob die letzte Synchronisierung nicht mit einem Fehler endete
Gelöschte Dokumente kann der Chatbot nicht mehr als Quelle verwenden. Um sie erneut einzufügen, müssen Sie die Originaldatei neu hochladen. Wenn Sie die Originaldatei nicht haben, löschen Sie das Dokument nicht.
Timeseries Insight — Anomalieerkennung und Vorhersage
Diese Engine findet Anomalien in Anlagendaten und erstellt Vorhersagen. Es ist der Service mit den meisten Menüs.
Analyse-Bildschirme
Nach Ziel gibt es immer ein Paar aus Anomalieerkennung (Anomaly Detection) und Vorhersage (Forecast).
| Gruppe | Bildschirm |
|---|---|
| Asset (Anlage) | Anomaly Detection · Forecast · Health Index (Anlagengesundheitswert) |
| Production (Produktion) | Anomaly Detection · Quality Forecast (Qualitätsvorhersage) |
| Alarm (Alarm) | Frequency Anomaly (Häufigkeitsanomalie) · Failure Forecast (Ausfallvorhersage) · Duration Analysis (Dauernanalyse) · Sensor Correlation (Sensorkorrelation) · Statistics (Statistiken) |
| System (System) | Anomaly Detection · Forecast |
| Profiling | Asset Profiling — eine Anlage im Detail betrachten |
Feature Store — Rohstoffe für die Analyse
Die obigen Analysen nutzen verarbeitete Daten, die im Feature Store gelagert werden. Wenn Analyseergebnisse leer oder veraltet sind, ist dies normalerweise die Ursache.
| Menü | Funktion |
|---|---|
| Pipeline Status | Zeigt, ob die Datenverarbeitung derzeit normal läuft |
| Run History | Ausführungsverlauf und Erfolgs-/Fehlerstatus |
| Feature Data | Abfrage der tatsächlich gespeicherten Werte |
| Backfill | Füllen Sie fehlende Zeiträume neu auf |
Dies ist eine Neuberechnung historischer Zeiträume, die lange dauert und die Serverauslastung erhöht, wenn der Bereich groß ist. Führen Sie dies während arbeitsarmer Zeiten durch und beschränken Sie sich auf die notwendigen Zeiträume. Falls Sie das zum ersten Mal tun, empfehlen wir, vorher mit Ihrem Administrator zu sprechen.
Document Parsing · Vision
Beide Services haben nur die vier gemeinsamen Menüs. In der Konsole geht es darum, zu überprüfen, ob sie funktionieren, und bei Problemen die Protokolle anzuschauen.
- Document Parsing — extrahiert Layout, Tabellen und Felder aus Dokumenten
- Vision — bestimmt Mängel auf Bildern oder liest Instrumententafeln ab
Beide sind interne Services, auf die Ihr Browser nicht direkt zugreifen kann — ihre Karten auf dem Startbildschirm sind daher nicht anklickbar. Die Konsole fragt ihren Status ab und zeigt ihn Ihnen.
Häufige Probleme und Lösungen
| Symptom | Zuerst hier nachschauen | Dann |
|---|---|---|
| Chatbot findet Dokumente nicht | RAG API → Documents | Mit Query Test direkt suchen → Sync History |
| Chatbot-Antworten sind langsam | LLM-P95-Spalte | GPU-Auslastung und Temperatur |
| Analyseergebnisse sind leer | Insight → Pipeline Status | Run History auf Fehler überprüfen |
| Startseite zeigt gelbe Leuchte | Statusliste ausfahren und Tooltip überprüfen | Den Service öffnen → Logs |
| Startseite zeigt rote Leuchte | Den Service öffnen → Logs | Service-Betrieb für Neustart-Verfahren |
| Bildschirm ist leer mit Fehlerstreifen | Service startet möglicherweise noch | Status auf Startseite überprüfen |
Die Konsole zeigt keinen leeren Tisch, wenn keine Daten verfügbar sind — sie zeigt einen Fehlerstreifen. Wenn ein Fehlerstreifen angezeigt wird, sind Daten nicht verfügbar, weil die Verbindung unterbrochen ist.
Konto und Sitzung
Die Konten für die Konsole werden nicht in einer Datenbank gespeichert, sondern via Umgebungsvariable konfiguriert.
| Umgebungsvariable | Bedeutung | Standardwert |
|---|---|---|
ADMIN_AUTH_USERNAME | Anmelde-Benutzername | admin |
ADMIN_AUTH_PASSWORD | Anmelde-Passwort | nicht vorhanden — muss festgelegt sein |
ADMIN_SESSION_SECRET | Sitzungs-Signaturschlüssel | Wenn leer, wird ein neuer beim Start erzeugt |
ADMIN_SESSION_MAX_AGE | Sitzungs-Gültigkeitsdauer (Minuten) | 480 (8 Stunden) |
Wenn ADMIN_AUTH_PASSWORD leer ist, weigert sich die Konsole zu starten. Dies ist beabsichtigt, um zu verhindern, dass ein Verwaltungsportal ohne Authentifizierung stillschweigend läuft.
Wenn ADMIN_SESSION_SECRET leer ist, wird ein neuer Signaturschlüssel bei jedem Neustart erstellt und alle Benutzer werden abgemeldet. Wenn Sie einen Wert festlegen, bleibt die Anmeldung über Neustarts hinweg erhalten.
bin/passwd.sh nicht geändert werdenDas Konsolenkonto gehört nicht zur Liste der Schlüssel, die bin/passwd.sh verwaltet (siehe Tabelle in Passwort und API-Schlüssel ändern). Zum Ändern müssen Sie die Umgebungsdatei direkt bearbeiten und den Service neu starten. Fragen Sie Ihren Administrator.
Verwandte Dokumente
- Service-Port-Map — Konsolenadresse und wo jeder Service läuft
- Service-Betrieb — Start-, Stopp- und Neustartverfahren
- Passwort und API-Schlüssel ändern — Schlüsselrotation
- Protokollierung und Monitoring — Direktes Anschauen von Protokollen auf dem Server