KI-Funktionen im Wiki (LLM Application)
Überblick
Dieses Wiki hat eine vollständige KI-Integration auf Basis der LLM Application (Version 0.8). Als LLM-Provider dient der GWDG Chat-AI-Dienst (Academic Cloud) mit OpenAI-kompatibler API.
Chat
Der KI-Chat ist auf zwei Wegen erreichbar:
- Über den ✨ Chat-Button unten rechts auf jeder Wiki-Seite
- Über die LLM Application Startseite
Verfügbare Modelle
| Modell | Kontext | Geeignet für |
|---|---|---|
| llama-3.1-8b-instruct | 128k | Schnelle, einfache Anfragen |
| qwen3.5-122b-a10b | 128k | Allround, mit Wiki-Kontext (RAG) |
| mistral-large-3-675b-instruct | 256k | Komplexe Aufgaben, lange Texte |
| deepseek-r1-distill-llama-70b | 32k | Reasoning-Aufgaben |
| qwen3-coder-30b-a3b-instruct | 128k | Code |
Wiki-Inhalte als Kontext (RAG)
Das Modell qwen3.5-122b-a10b beantwortet Fragen mit Kontext aus dem Wiki: Die Collection wiki-inhalte indexiert die Spaces Main und Documentation (Embedding-Modell: multilingual-e5-large-instruct, 1000-Zeichen-Chunks). Antworten enthalten Quellenangaben.
Geänderte Seiten in den indexierten Spaces werden automatisch neu indexiert. Weitere Spaces lassen sich in der Collection-Konfiguration ergänzen.
KI im Editor
Im WYSIWYG-Editor:
- ✨-Icon in der Toolbar (aktiv bei Textauswahl): Umschreiben, Zusammenfassen etc.
- /-Quick-Action: / tippen und die AI-Aktion wählen, um Text generieren zu lassen
Eigene Prompts
In der Prompt-Datenbank lassen sich wiederverwendbare System-Prompts anlegen, die im Chat per Dropdown auswählbar sind.
API-Zugriff
OpenAI-kompatible API
Das Wiki stellt selbst eine OpenAI-kompatible API bereit (mit Wiki-Rechteprüfung):
GET /rest/wikis/xwiki/aiLLM/v1/models
MCP-Server
Für KI-Agents (z.B. Claude Code) gibt es einen MCP-Endpoint (Streamable HTTP):
Tools: search_wiki (RAG-Suche über die Collections), list_collections.
Authentifizierung über die Token-Auth-Extension: Externe Anwendungen werden unter Authorized Applications mit einem Ed25519-Public-Key registriert und schicken EdDSA-signierte JWTs als Bearer-Token (iss = registrierte App-URL, aud = Wiki-Root-URL, exp max. 25h). Ohne Token laufen Anfragen als Gast.
Administration
- Server-Einstellungen — LLM-Server (URL-Prefix muss mit / enden), API-Token, Chat-Widget
- Modelle — Modell-Einträge. Wichtig: ohne Group-Zuweisung ist ein Modell für niemanden sichtbar; bei Embedding-Modellen Maximum parallelism klein halten (z.B. 5), sonst lehnt die GWDG-API große Batches ab
- Collections — RAG-Indexe; Chunk-Größe muss zum Token-Limit des Embedding-Modells passen (512 Tokens ≈ 1000 Zeichen)
Eingerichtet: Juli 2026