Kategorien
Seiten
-

IT Center Changes

Erster Produktivrelease nach öffentlicher Testphase [1.0.0]

29. Juni 2026 | von

Erste Hauptversion des einsatzfähigen Produkts nach Abschluss der öffentlichen Testphase.

Funktionen:

  • Query Planner – Überarbeitung des RAG-Retrievals: Ein vorgeschalteter, ressourcenschonender LLM-Aufruf (gpt-5.4-mini) erzeugt vor der Dokumentensuche eine bereinigte, themenreine Suchanfrage und ersetzt die bisherige embeddingbasierte Heuristik zur Themenwechsel-Erkennung. Ergebnis: präzisere RAG-Treffer und keine Themenvermischung mehr (z. B. die Verschmelzung von VPN und HPC zu einer fehlerhaften Anfrage). Vollständig zur Laufzeit über einen neuen Reiter im Env Manager konfigurierbar; robuster Fallback, der einen Chat bei Planner-Fehler oder Timeout nie unterbricht.
  • Themenspezifische Suchsprache: HPC-/Cluster-Anfragen werden auf Englisch durchsucht (die Wissensdatenbank ist englischsprachig), während die Antwort in der Sprache des Nutzers verbleibt.
  • Expliziter Sprachwechsel: Aufforderungen wie „answer in English“ oder „auf Deutsch bitte“ wechseln nun die Antwortsprache.
  • Präzisere Störungserkennung: Ein Störungsblock wird nur noch eingeblendet, wenn der Nutzer tatsächlich nach einer Störung fragt, und nicht bereits bei der bloßen Erwähnung eines Dienstes.
  • Screenshot-Upload (Vision-Unterstützung): Bilder lassen sich per Einfügen, Dateiauswahl oder Drag-and-drop anhängen. Der Client skaliert auf WebP herunter, der Server validiert und kodiert die Daten über Pillow neu. Screenshots bleiben über Folgefragen hinweg im Kontext; Aufbewahrungsbereinigung nach konfigurierbarer Anzahl von Tagen.
  • Dark Mode: Neues Theme-System mit dunklem Stylesheet und Umschaltfunktion.
  • Testfälle pro Nachricht und promptfoo-Export: Administratoren können einen Frage-Antwort-Turn als Testfall markieren, die erwartete Antwort sowie die korrekten Dokumentationslinks erfassen und alles als promptfoo-kompatible YAML-Datei für die automatisierte Qualitätsbewertung exportieren.

Intern/Architektur

  • Die monolithische bot.py (775 Zeilen) wurde in ein strukturiertes Paket app/bot/ aufgeteilt (pipeline, client, search, language, tokens, incidents, query_planner).
  • routes.py wurde in Unterpakete unter app/routes/ modularisiert.
  • Integrierter Deployment-Webhook (seko_deploy_webhook), erweiterte Testsuite, Aktualisierungen der CI/CD.

Fehlerbehebungen und Verbesserungen:

  • Quellenangaben: Nachverfolgung der RAG-Dokumente; geteilte Chats weisen nun die verwendeten Quellen aus („Quellen“).
  • Überarbeitung des Feedback-Review-Systems: modularisierte Review-Oberfläche, eine Flag-Queue für auffällige Chats sowie eine Datenbanknormalisierung (Enums und Lookup-Tabellen für Feedback-Kategorien und KI-Modelle).
  • Überarbeitung des Env Managers: datenbankbasierte Konfiguration mit bidirektionaler .env-Synchronisierung, Side-by-Side-Oberfläche, dediziertem Schreib-Benutzer und Export einer zusammengeführten .env.
  • Störungsverarbeitung: Priorisierung nach Schweregrad, zeitbasierte Filterung, Kürzung nach Token-Budget sowie klickbare Links.
  • Aktuelle GPT-Modelle: Token-Erfassung und Modell-Routing für die neuesten GPT-5.x-Deployments aktualisiert.
  • Eval-API: neuer Endpunkt für automatisierte Evaluierungsläufe.

Die Kommentare sind geschlossen.