- Quota (app/quota.py): Anfragen pro Nutzer/Tag (usage-Tabelle), DAILY_REQUEST_LIMIT, pro Nutzer via prefs uebersteuerbar; 429 (REST) bzw. error-Event (WS); Metrik - Notfall (app/safety/emergency.py): heuristische Erkennung (de/en); Log im Store (emergency_events) + optionaler Webhook (best-effort) + X-Emergency/emergency-Event; Metrik emergency_total; Notfaelle umgehen das Kontingent - verdrahtet in chat/speak/transcribe + WS-Turns - Tests: 64 gruen (+6); Doku aktualisiert (README, BEDIENUNGSANLEITUNG, Architektur, .env.example) Hinweis: Notfall-Erkennung ist eine Heuristik (kein Lebensretter); erkannte Texte sind sensibel -> DSGVO beachten. Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
48 lines
1.9 KiB
Bash
48 lines
1.9 KiB
Bash
# Port bei Bedarf anpassen
|
|
APP_ENV=dev
|
|
HOST=0.0.0.0
|
|
PORT=8080
|
|
LOG_LEVEL=info
|
|
|
|
# Secret nur ueber die Umgebung setzen (nicht hier eintragen), z. B. export in ~/.bashrc
|
|
OPENROUTER_API_KEY=
|
|
|
|
# --- Authentifizierung -----------------------------------------------------
|
|
# AUTH_ENABLED=true (Standard) schuetzt chat/speak/transcribe/sessions per Bearer-Token.
|
|
# Fuer lokale Entwicklung/Tests auf false setzen (dann gilt ein anonymer Nutzer).
|
|
AUTH_ENABLED=true
|
|
# Schluessel fuer die Nutzerverwaltung (POST /api/admin/users). Nur ueber die Umgebung.
|
|
ADMIN_API_KEY=
|
|
|
|
# --- Zentrale Konfiguration / Profile -------------------------------------
|
|
# Aktives Profil aus config/voice-assistant.toml waehlen: local-dev | hybrid | cloud
|
|
# (leer lassen = nur Defaults/ENV). Eigener Pfad via VA_CONFIG_FILE.
|
|
VA_PROFILE=
|
|
# VA_CONFIG_FILE=config/voice-assistant.toml
|
|
|
|
# Hinweis zur Praezedenz: ENV gewinnt ueber die TOML-Datei. Die DEFAULT_*_PROVIDER-
|
|
# Zeilen unten ueberschreiben daher ein gesetztes VA_PROFILE. Wer profilbasiert
|
|
# umschalten will, sollte sie auskommentiert lassen.
|
|
OPENROUTER_STT_MODEL=openai/whisper-large-v3
|
|
OPENROUTER_TTS_MODEL=openai/gpt-4o-mini-tts
|
|
OPENROUTER_TTS_VOICE=alloy
|
|
OPENROUTER_LLM_MODEL=openai/gpt-4.1-mini
|
|
DEFAULT_LANGUAGE=de
|
|
DEFAULT_INPUT_ENDPOINT=local-default
|
|
DEFAULT_OUTPUT_ENDPOINT=local-default
|
|
# DEFAULT_STT_PROVIDER=openrouter
|
|
# DEFAULT_LLM_PROVIDER=local-openai-compatible
|
|
# DEFAULT_TTS_PROVIDER=openrouter
|
|
LOCAL_LLM_BASE_URL=http://127.0.0.1:11434/v1
|
|
LOCAL_LLM_API_KEY=dummy
|
|
LOCAL_LLM_MODEL=llama3.1
|
|
|
|
# --- Resilienz: Fallback-Ketten (kommaseparierte Provider-Namen) ------------
|
|
# Faellt der primaere Provider aus, uebernimmt der naechste.
|
|
# STT_FALLBACK=faster-whisper
|
|
# LLM_FALLBACK=local-openai-compatible
|
|
# TTS_FALLBACK=piper
|
|
|
|
# --- Betrieb: Kontingent & Notfall -----------------------------------------
|
|
DAILY_REQUEST_LIMIT=0 # Anfragen pro Nutzer/Tag (0 = unbegrenzt)
|
|
# EMERGENCY_WEBHOOK_URL=https://example.org/alert # optionale Eskalation
|