Erste Hauptversion des einsatzfähigen Produkts nach Abschluss der öffentlichen Testphase.
Funktionen:
- Query Planner – Überarbeitung des RAG-Retrievals: Ein vorgeschalteter, ressourcenschonender LLM-Aufruf (gpt-5.4-mini) erzeugt vor der Dokumentensuche eine bereinigte, themenreine Suchanfrage und ersetzt die bisherige embeddingbasierte Heuristik zur Themenwechsel-Erkennung. Ergebnis: präzisere RAG-Treffer und keine Themenvermischung mehr (z. B. die Verschmelzung von VPN und HPC zu einer fehlerhaften Anfrage). Vollständig zur Laufzeit über einen neuen Reiter im Env Manager konfigurierbar; robuster Fallback, der einen Chat bei Planner-Fehler oder Timeout nie unterbricht.
- Themenspezifische Suchsprache: HPC-/Cluster-Anfragen werden auf Englisch durchsucht (die Wissensdatenbank ist englischsprachig), während die Antwort in der Sprache des Nutzers verbleibt.
- Expliziter Sprachwechsel: Aufforderungen wie „answer in English“ oder „auf Deutsch bitte“ wechseln nun die Antwortsprache.
- Präzisere Störungserkennung: Ein Störungsblock wird nur noch eingeblendet, wenn der Nutzer tatsächlich nach einer Störung fragt, und nicht bereits bei der bloßen Erwähnung eines Dienstes.
- Screenshot-Upload (Vision-Unterstützung): Bilder lassen sich per Einfügen, Dateiauswahl oder Drag-and-drop anhängen. Der Client skaliert auf WebP herunter, der Server validiert und kodiert die Daten über Pillow neu. Screenshots bleiben über Folgefragen hinweg im Kontext; Aufbewahrungsbereinigung nach konfigurierbarer Anzahl von Tagen.
- Dark Mode: Neues Theme-System mit dunklem Stylesheet und Umschaltfunktion.
- Testfälle pro Nachricht und promptfoo-Export: Administratoren können einen Frage-Antwort-Turn als Testfall markieren, die erwartete Antwort sowie die korrekten Dokumentationslinks erfassen und alles als promptfoo-kompatible YAML-Datei für die automatisierte Qualitätsbewertung exportieren.
Intern/Architektur
- Die monolithische bot.py (775 Zeilen) wurde in ein strukturiertes Paket app/bot/ aufgeteilt (pipeline, client, search, language, tokens, incidents, query_planner).
- routes.py wurde in Unterpakete unter app/routes/ modularisiert.
- Integrierter Deployment-Webhook (seko_deploy_webhook), erweiterte Testsuite, Aktualisierungen der CI/CD.
Fehlerbehebungen und Verbesserungen:
- Quellenangaben: Nachverfolgung der RAG-Dokumente; geteilte Chats weisen nun die verwendeten Quellen aus („Quellen“).
- Überarbeitung des Feedback-Review-Systems: modularisierte Review-Oberfläche, eine Flag-Queue für auffällige Chats sowie eine Datenbanknormalisierung (Enums und Lookup-Tabellen für Feedback-Kategorien und KI-Modelle).
- Überarbeitung des Env Managers: datenbankbasierte Konfiguration mit bidirektionaler .env-Synchronisierung, Side-by-Side-Oberfläche, dediziertem Schreib-Benutzer und Export einer zusammengeführten .env.
- Störungsverarbeitung: Priorisierung nach Schweregrad, zeitbasierte Filterung, Kürzung nach Token-Budget sowie klickbare Links.
- Aktuelle GPT-Modelle: Token-Erfassung und Modell-Routing für die neuesten GPT-5.x-Deployments aktualisiert.
- Eval-API: neuer Endpunkt für automatisierte Evaluierungsläufe.

