feat: Resilienz (Fallback-Ketten) und Metriken (#5)
- Fallback-Provider (app/providers/fallback.py) fuer STT/LLM/TTS: Provider-Kette der Reihe nach; Config *_FALLBACK; build_orchestrator baut Ketten (dedupliziert) - LLM-Stream-Fallback nur solange kein Token gesendet wurde - Metriken (app/metrics.py): In-Memory Counter/Timer, keine externe Dependency - HTTP-Middleware (Requests/Latenz/Status je Pfad); Pipeline-Stufen-Timing stt/llm/tts; Fallback-/Fehlerzaehler; GET /api/metrics (JSON + Prometheus) - Tests: 58 gruen (+6); Doku aktualisiert (README, BEDIENUNGSANLEITUNG, Architektur, .env.example) Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
This commit is contained in:
parent
093da817d8
commit
6422444017
13 changed files with 452 additions and 23 deletions
|
|
@ -36,3 +36,9 @@ DEFAULT_OUTPUT_ENDPOINT=local-default
|
|||
LOCAL_LLM_BASE_URL=http://127.0.0.1:11434/v1
|
||||
LOCAL_LLM_API_KEY=dummy
|
||||
LOCAL_LLM_MODEL=llama3.1
|
||||
|
||||
# --- Resilienz: Fallback-Ketten (kommaseparierte Provider-Namen) ------------
|
||||
# Faellt der primaere Provider aus, uebernimmt der naechste.
|
||||
# STT_FALLBACK=faster-whisper
|
||||
# LLM_FALLBACK=local-openai-compatible
|
||||
# TTS_FALLBACK=piper
|
||||
|
|
|
|||
Loading…
Add table
Add a link
Reference in a new issue