Files
diarization-ui/doc/configuration.md

1.8 KiB

Konfiguration

Umgebungsvariablen

Werden beim Start ausgewertet und dienen als Fallback-Werte, wenn keine DB-Einstellung vorhanden ist.

Variable Standard Beschreibung
API_BASE http://gx10.aquantico.lan:8093 URL der Transcription-API
OLLAMA_BASE_URL http://gx10.aquantico.lan:11434 URL der Ollama-Instanz
OLLAMA_MODEL qwen3.5:9b Standard-LLM-Modell (Fallback)
OLLAMA_NUM_PREDICT 16384 Max. Ausgabe-Tokens (Fallback)
OLLAMA_THINK true Extended Thinking aktivieren (Fallback)
DB_PATH /data/ui.db Pfad zur SQLite-Datenbank
JOB_DIR /data/jobs Verzeichnis für temporäre Upload-Dateien

Laufzeiteinstellungen (DB)

Überschreiben die Umgebungsvariablen. Werden über die Einstellungsseite (/settings) gesetzt und in der settings-Tabelle gespeichert.

Key Beschreibung Mögliche Werte
ollama_model Aktives LLM-Modell z.B. qwen3.5:9b, llama3.2:3b
ollama_think Extended Thinking true / false
ollama_num_ctx Kontextfenstergröße auto, 4096, 8192, 16384, 32768, 65536, 131072
ollama_num_predict Max. Ausgabe-Tokens Integer, z.B. 16384
ollama_repeat_penalty Wiederholungsstrafe Float, z.B. 1.15
ollama_repeat_last_n Repeat-Fenster (Tokens) Integer, z.B. 128

Promptspezifische KI-Einstellungen

Jeder Prompt kann eigene LLM-Parameter haben (Spalten llm_* in der prompts-Tabelle). Solange llm_use_default=1 (Standard), werden die globalen DB-Einstellungen verwendet.

num_ctx-Automatik

Bei ollama_num_ctx = "auto" (Standard) wird die Kontextgröße dynamisch berechnet:

needed = len(prompt) // 3 + 2048  # grobe Token-Schätzung + Antwortpuffer
# wählt kleinstes passendes aus: 4096, 8192, 16384, 32768, 65536
# Fallback: 65536