KI-Funktionen im Wiki (LLM Application)

Last modified by Claude Code on 2026/07/03 20:25

Überblick

Dieses Wiki hat eine vollständige KI-Integration auf Basis der LLM Application (Version 0.8). Als LLM-Provider dient der GWDG Chat-AI-Dienst (Academic Cloud) mit OpenAI-kompatibler API.

Chat

Der KI-Chat ist auf zwei Wegen erreichbar:

  • Über den ✨ Chat-Button unten rechts auf jeder Wiki-Seite
  • Über die LLM Application Startseite

Verfügbare Modelle

ModellKontextGeeignet für
llama-3.1-8b-instruct128kSchnelle, einfache Anfragen
qwen3.5-122b-a10b128kAllround, mit Wiki-Kontext (RAG)
mistral-large-3-675b-instruct256kKomplexe Aufgaben, lange Texte
deepseek-r1-distill-llama-70b32kReasoning-Aufgaben
qwen3-coder-30b-a3b-instruct128kCode

Wiki-Inhalte als Kontext (RAG)

Das Modell qwen3.5-122b-a10b beantwortet Fragen mit Kontext aus dem Wiki: Die Collection wiki-inhalte indexiert die Spaces Main und Documentation (Embedding-Modell: multilingual-e5-large-instruct, 1000-Zeichen-Chunks). Antworten enthalten Quellenangaben.

Geänderte Seiten in den indexierten Spaces werden automatisch neu indexiert. Weitere Spaces lassen sich in der Collection-Konfiguration ergänzen.

KI im Editor

Im WYSIWYG-Editor:

  • ✨-Icon in der Toolbar (aktiv bei Textauswahl): Umschreiben, Zusammenfassen etc.
  • /-Quick-Action: / tippen und die AI-Aktion wählen, um Text generieren zu lassen

Eigene Prompts

In der Prompt-Datenbank lassen sich wiederverwendbare System-Prompts anlegen, die im Chat per Dropdown auswählbar sind.

API-Zugriff

OpenAI-kompatible API

Das Wiki stellt selbst eine OpenAI-kompatible API bereit (mit Wiki-Rechteprüfung):

POST /rest/wikis/xwiki/aiLLM/v1/chat/completions
GET  /rest/wikis/xwiki/aiLLM/v1/models

MCP-Server

Für KI-Agents (z.B. Claude Code) gibt es einen MCP-Endpoint (Streamable HTTP):

POST /rest/wikis/xwiki/aiLLM/mcp

Tools: search_wiki (RAG-Suche über die Collections), list_collections.

Authentifizierung über die Token-Auth-Extension: Externe Anwendungen werden unter Authorized Applications mit einem Ed25519-Public-Key registriert und schicken EdDSA-signierte JWTs als Bearer-Token (iss = registrierte App-URL, aud = Wiki-Root-URL, exp max. 25h). Ohne Token laufen Anfragen als Gast.

Administration

  • Server-Einstellungen — LLM-Server (URL-Prefix muss mit / enden), API-Token, Chat-Widget
  • Modelle — Modell-Einträge. Wichtig: ohne Group-Zuweisung ist ein Modell für niemanden sichtbar; bei Embedding-Modellen Maximum parallelism klein halten (z.B. 5), sonst lehnt die GWDG-API große Batches ab
  • Collections — RAG-Indexe; Chunk-Größe muss zum Token-Limit des Embedding-Modells passen (512 Tokens ≈ 1000 Zeichen)

Eingerichtet: Juli 2026