1.8 KiB
1.8 KiB
Konfiguration
Umgebungsvariablen
Werden beim Start ausgewertet und dienen als Fallback-Werte, wenn keine DB-Einstellung vorhanden ist.
| Variable | Standard | Beschreibung |
|---|---|---|
API_BASE |
http://gx10.aquantico.lan:8093 |
URL der Transcription-API |
OLLAMA_BASE_URL |
http://gx10.aquantico.lan:11434 |
URL der Ollama-Instanz |
OLLAMA_MODEL |
qwen3.5:9b |
Standard-LLM-Modell (Fallback) |
OLLAMA_NUM_PREDICT |
16384 |
Max. Ausgabe-Tokens (Fallback) |
OLLAMA_THINK |
true |
Extended Thinking aktivieren (Fallback) |
DB_PATH |
/data/ui.db |
Pfad zur SQLite-Datenbank |
JOB_DIR |
/data/jobs |
Verzeichnis für temporäre Upload-Dateien |
Laufzeiteinstellungen (DB)
Überschreiben die Umgebungsvariablen. Werden über die Einstellungsseite (/settings) gesetzt und in der settings-Tabelle gespeichert.
| Key | Beschreibung | Mögliche Werte |
|---|---|---|
ollama_model |
Aktives LLM-Modell | z.B. qwen3.5:9b, llama3.2:3b |
ollama_think |
Extended Thinking | true / false |
ollama_num_ctx |
Kontextfenstergröße | auto, 4096, 8192, 16384, 32768, 65536, 131072 |
ollama_num_predict |
Max. Ausgabe-Tokens | Integer, z.B. 16384 |
ollama_repeat_penalty |
Wiederholungsstrafe | Float, z.B. 1.15 |
ollama_repeat_last_n |
Repeat-Fenster (Tokens) | Integer, z.B. 128 |
Promptspezifische KI-Einstellungen
Jeder Prompt kann eigene LLM-Parameter haben (Spalten llm_* in der prompts-Tabelle). Solange llm_use_default=1 (Standard), werden die globalen DB-Einstellungen verwendet.
num_ctx-Automatik
Bei ollama_num_ctx = "auto" (Standard) wird die Kontextgröße dynamisch berechnet:
needed = len(prompt) // 3 + 2048 # grobe Token-Schätzung + Antwortpuffer
# wählt kleinstes passendes aus: 4096, 8192, 16384, 32768, 65536
# Fallback: 65536