- Fallback-Provider (app/providers/fallback.py) fuer STT/LLM/TTS: Provider-Kette der Reihe nach; Config *_FALLBACK; build_orchestrator baut Ketten (dedupliziert) - LLM-Stream-Fallback nur solange kein Token gesendet wurde - Metriken (app/metrics.py): In-Memory Counter/Timer, keine externe Dependency - HTTP-Middleware (Requests/Latenz/Status je Pfad); Pipeline-Stufen-Timing stt/llm/tts; Fallback-/Fehlerzaehler; GET /api/metrics (JSON + Prometheus) - Tests: 58 gruen (+6); Doku aktualisiert (README, BEDIENUNGSANLEITUNG, Architektur, .env.example) Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
13 lines
415 B
Python
13 lines
415 B
Python
from fastapi import APIRouter, Query
|
|
from fastapi.responses import PlainTextResponse
|
|
|
|
from app.metrics import metrics
|
|
|
|
router = APIRouter()
|
|
|
|
|
|
@router.get("/metrics")
|
|
async def get_metrics(format: str = Query(default="json", description="json | prometheus")):
|
|
if format == "prometheus":
|
|
return PlainTextResponse(metrics.prometheus(), media_type="text/plain; version=0.0.4")
|
|
return metrics.snapshot()
|