2026-06-17 05:19:07 +02:00
|
|
|
"""Fallback-Ketten: versuchen mehrere Provider der Reihe nach.
|
|
|
|
|
|
|
|
|
|
Faellt der primaere Provider aus (Timeout/Fehler), wird transparent der naechste
|
|
|
|
|
versucht. Erfolgreicher Fallback und Provider-Fehler werden als Metrik erfasst.
|
|
|
|
|
"""
|
|
|
|
|
|
|
|
|
|
from collections.abc import AsyncIterator
|
|
|
|
|
|
|
|
|
|
from app.metrics import metrics
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
class _Chain:
|
|
|
|
|
def __init__(self, module: str, entries: list[tuple[str, object]]):
|
|
|
|
|
self.module = module
|
|
|
|
|
self.entries = entries # [(provider_name, provider), ...]
|
|
|
|
|
|
|
|
|
|
def _on_error(self, name: str) -> None:
|
|
|
|
|
metrics.inc("provider_error_total", {"module": self.module, "provider": name})
|
|
|
|
|
|
|
|
|
|
def _on_fallback(self) -> None:
|
|
|
|
|
metrics.inc("provider_fallback_total", {"module": self.module})
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
class FallbackSTTProvider(_Chain):
|
|
|
|
|
async def transcribe(self, audio_bytes, fmt, language=None) -> str:
|
|
|
|
|
last_exc = None
|
|
|
|
|
for index, (name, provider) in enumerate(self.entries):
|
|
|
|
|
try:
|
|
|
|
|
result = await provider.transcribe(audio_bytes, fmt, language=language)
|
|
|
|
|
if index > 0:
|
|
|
|
|
self._on_fallback()
|
|
|
|
|
return result
|
|
|
|
|
except Exception as exc: # noqa: BLE001 - bewusst breit fuer Resilienz
|
|
|
|
|
last_exc = exc
|
|
|
|
|
self._on_error(name)
|
|
|
|
|
raise last_exc
|
|
|
|
|
|
feat: Geräte-TTS, native Stimmen, Favicon, Auth-Gate, UI-Fixes
Web-UI / TTS:
- Geräte-TTS ("📱 Gerät"): Antwort wird on-device vorgelesen (Web Speech
API), Server sendet nur Text (text_only) -> spart Bandbreite/Kosten.
Mobil-Default, geräte-lokale Speicherung, iOS-Autoplay-Freischaltung.
- Vorlese-Symbol (🔊) je Bubble: Hybrid-Replay (Assistent-PCM gecacht,
Eingabe via /api/speak); SVG-Icon mit kontrastreicher Farbe.
- Kombiniertes Sprachmenü (Flex + feste Sprachen) statt separatem Modus-Menü.
- "Neues Gespräch"-Button (frische Session gegen Sprach-Trägheit).
- Dark-Mode: lesbare <option>-Popups (Kontrast-Fix).
- Favicon (SVG + PNG-Fallbacks) aus mund.png.
TTS-Backend:
- Sprache wird an alle TTS-Provider durchgereicht; Piper-Stimme folgt der
Sprache; Chatterbox mehrsprachig + cross-lingual.
- Native Referenz-Stimmen je Sprache (config/voices/<lang>.wav, FLEURS CC-BY),
loudness-normalisiert.
LLM-Sprache:
- Antwort folgt zuverlässig der gewählten Sprache (verstärkte Anweisung +
Erinnerung an der letzten Nutzer-Nachricht gegen History-Trägheit).
Admin / Auth:
- Wörterbuch: alle 8 Sprachen, Zeilen editierbar, alphabetische Sortierung.
- Web-UI hinter Auth-Gate (Redirect auf SSO_LOGIN_URL / 401); Favicons offen.
- Log-Tab: Hinweis, wenn der systemd-Dienst nicht aktiv ist.
- Einstellungen: Hinweis "pro Nutzer überschreibbar" bei Sprache/Modus/Qualität.
Doku (BEDIENUNGSANLEITUNG.md): Geräte-TTS §6.5.0, Fix/Flex §6.6, native
Stimmen §6.5.3, llama.cpp<->Ollama-Wechsel §4.7, Auth/SSO §7.4.
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
2026-06-20 13:12:04 +02:00
|
|
|
async def transcribe_detect(self, audio_bytes, fmt, language=None) -> tuple[str, str | None]:
|
|
|
|
|
last_exc = None
|
|
|
|
|
for index, (name, provider) in enumerate(self.entries):
|
|
|
|
|
try:
|
|
|
|
|
result = await provider.transcribe_detect(audio_bytes, fmt, language=language)
|
|
|
|
|
if index > 0:
|
|
|
|
|
self._on_fallback()
|
|
|
|
|
return result
|
|
|
|
|
except Exception as exc: # noqa: BLE001
|
|
|
|
|
last_exc = exc
|
|
|
|
|
self._on_error(name)
|
|
|
|
|
raise last_exc
|
|
|
|
|
|
2026-06-17 05:19:07 +02:00
|
|
|
|
|
|
|
|
class FallbackLLMProvider(_Chain):
|
2026-06-19 14:12:16 +02:00
|
|
|
async def complete(self, text, history=None, session_id=None, language=None) -> str:
|
2026-06-17 05:19:07 +02:00
|
|
|
last_exc = None
|
|
|
|
|
for index, (name, provider) in enumerate(self.entries):
|
|
|
|
|
try:
|
2026-06-19 14:12:16 +02:00
|
|
|
result = await provider.complete(
|
|
|
|
|
text, history=history, session_id=session_id, language=language
|
|
|
|
|
)
|
2026-06-17 05:19:07 +02:00
|
|
|
if index > 0:
|
|
|
|
|
self._on_fallback()
|
|
|
|
|
return result
|
|
|
|
|
except Exception as exc: # noqa: BLE001
|
|
|
|
|
last_exc = exc
|
|
|
|
|
self._on_error(name)
|
|
|
|
|
raise last_exc
|
|
|
|
|
|
2026-06-19 14:12:16 +02:00
|
|
|
async def stream(self, text, history=None, session_id=None, language=None) -> AsyncIterator[str]:
|
2026-06-17 05:19:07 +02:00
|
|
|
last_exc = None
|
|
|
|
|
for index, (name, provider) in enumerate(self.entries):
|
|
|
|
|
produced = False
|
|
|
|
|
try:
|
2026-06-19 14:12:16 +02:00
|
|
|
async for delta in provider.stream(
|
|
|
|
|
text, history=history, session_id=session_id, language=language
|
|
|
|
|
):
|
2026-06-17 05:19:07 +02:00
|
|
|
produced = True
|
|
|
|
|
yield delta
|
|
|
|
|
if index > 0:
|
|
|
|
|
self._on_fallback()
|
|
|
|
|
return
|
|
|
|
|
except Exception as exc: # noqa: BLE001
|
|
|
|
|
last_exc = exc
|
|
|
|
|
self._on_error(name)
|
|
|
|
|
if produced:
|
|
|
|
|
# Schon Token gesendet -> kein Fallback mehr moeglich.
|
|
|
|
|
raise
|
|
|
|
|
raise last_exc
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
class FallbackTTSProvider(_Chain):
|
feat: Geräte-TTS, native Stimmen, Favicon, Auth-Gate, UI-Fixes
Web-UI / TTS:
- Geräte-TTS ("📱 Gerät"): Antwort wird on-device vorgelesen (Web Speech
API), Server sendet nur Text (text_only) -> spart Bandbreite/Kosten.
Mobil-Default, geräte-lokale Speicherung, iOS-Autoplay-Freischaltung.
- Vorlese-Symbol (🔊) je Bubble: Hybrid-Replay (Assistent-PCM gecacht,
Eingabe via /api/speak); SVG-Icon mit kontrastreicher Farbe.
- Kombiniertes Sprachmenü (Flex + feste Sprachen) statt separatem Modus-Menü.
- "Neues Gespräch"-Button (frische Session gegen Sprach-Trägheit).
- Dark-Mode: lesbare <option>-Popups (Kontrast-Fix).
- Favicon (SVG + PNG-Fallbacks) aus mund.png.
TTS-Backend:
- Sprache wird an alle TTS-Provider durchgereicht; Piper-Stimme folgt der
Sprache; Chatterbox mehrsprachig + cross-lingual.
- Native Referenz-Stimmen je Sprache (config/voices/<lang>.wav, FLEURS CC-BY),
loudness-normalisiert.
LLM-Sprache:
- Antwort folgt zuverlässig der gewählten Sprache (verstärkte Anweisung +
Erinnerung an der letzten Nutzer-Nachricht gegen History-Trägheit).
Admin / Auth:
- Wörterbuch: alle 8 Sprachen, Zeilen editierbar, alphabetische Sortierung.
- Web-UI hinter Auth-Gate (Redirect auf SSO_LOGIN_URL / 401); Favicons offen.
- Log-Tab: Hinweis, wenn der systemd-Dienst nicht aktiv ist.
- Einstellungen: Hinweis "pro Nutzer überschreibbar" bei Sprache/Modus/Qualität.
Doku (BEDIENUNGSANLEITUNG.md): Geräte-TTS §6.5.0, Fix/Flex §6.6, native
Stimmen §6.5.3, llama.cpp<->Ollama-Wechsel §4.7, Auth/SSO §7.4.
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
2026-06-20 13:12:04 +02:00
|
|
|
async def synthesize(self, text, voice=None, audio_format="pcm", language=None) -> bytes:
|
2026-06-17 05:19:07 +02:00
|
|
|
last_exc = None
|
|
|
|
|
for index, (name, provider) in enumerate(self.entries):
|
|
|
|
|
try:
|
feat: Geräte-TTS, native Stimmen, Favicon, Auth-Gate, UI-Fixes
Web-UI / TTS:
- Geräte-TTS ("📱 Gerät"): Antwort wird on-device vorgelesen (Web Speech
API), Server sendet nur Text (text_only) -> spart Bandbreite/Kosten.
Mobil-Default, geräte-lokale Speicherung, iOS-Autoplay-Freischaltung.
- Vorlese-Symbol (🔊) je Bubble: Hybrid-Replay (Assistent-PCM gecacht,
Eingabe via /api/speak); SVG-Icon mit kontrastreicher Farbe.
- Kombiniertes Sprachmenü (Flex + feste Sprachen) statt separatem Modus-Menü.
- "Neues Gespräch"-Button (frische Session gegen Sprach-Trägheit).
- Dark-Mode: lesbare <option>-Popups (Kontrast-Fix).
- Favicon (SVG + PNG-Fallbacks) aus mund.png.
TTS-Backend:
- Sprache wird an alle TTS-Provider durchgereicht; Piper-Stimme folgt der
Sprache; Chatterbox mehrsprachig + cross-lingual.
- Native Referenz-Stimmen je Sprache (config/voices/<lang>.wav, FLEURS CC-BY),
loudness-normalisiert.
LLM-Sprache:
- Antwort folgt zuverlässig der gewählten Sprache (verstärkte Anweisung +
Erinnerung an der letzten Nutzer-Nachricht gegen History-Trägheit).
Admin / Auth:
- Wörterbuch: alle 8 Sprachen, Zeilen editierbar, alphabetische Sortierung.
- Web-UI hinter Auth-Gate (Redirect auf SSO_LOGIN_URL / 401); Favicons offen.
- Log-Tab: Hinweis, wenn der systemd-Dienst nicht aktiv ist.
- Einstellungen: Hinweis "pro Nutzer überschreibbar" bei Sprache/Modus/Qualität.
Doku (BEDIENUNGSANLEITUNG.md): Geräte-TTS §6.5.0, Fix/Flex §6.6, native
Stimmen §6.5.3, llama.cpp<->Ollama-Wechsel §4.7, Auth/SSO §7.4.
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
2026-06-20 13:12:04 +02:00
|
|
|
result = await provider.synthesize(
|
|
|
|
|
text, voice=voice, audio_format=audio_format, language=language
|
|
|
|
|
)
|
2026-06-17 05:19:07 +02:00
|
|
|
if index > 0:
|
|
|
|
|
self._on_fallback()
|
|
|
|
|
return result
|
|
|
|
|
except Exception as exc: # noqa: BLE001
|
|
|
|
|
last_exc = exc
|
|
|
|
|
self._on_error(name)
|
|
|
|
|
raise last_exc
|