2026-06-17 01:48:56 +02:00
|
|
|
import json
|
|
|
|
|
|
|
|
|
|
from fastapi.testclient import TestClient
|
|
|
|
|
|
|
|
|
|
import app.dependencies as deps
|
|
|
|
|
from app.main import app
|
|
|
|
|
from tests.conftest import loopback_output
|
|
|
|
|
|
|
|
|
|
client = TestClient(app)
|
|
|
|
|
|
|
|
|
|
|
2026-06-17 22:11:20 +02:00
|
|
|
def _stub_tts(monkeypatch, name="stub-tts", audio=b""):
|
|
|
|
|
"""Registriert einen deterministischen TTS-Stub (kein Netz, kein lokales Binary)."""
|
|
|
|
|
class StubTTS:
|
feat: Geräte-TTS, native Stimmen, Favicon, Auth-Gate, UI-Fixes
Web-UI / TTS:
- Geräte-TTS ("📱 Gerät"): Antwort wird on-device vorgelesen (Web Speech
API), Server sendet nur Text (text_only) -> spart Bandbreite/Kosten.
Mobil-Default, geräte-lokale Speicherung, iOS-Autoplay-Freischaltung.
- Vorlese-Symbol (🔊) je Bubble: Hybrid-Replay (Assistent-PCM gecacht,
Eingabe via /api/speak); SVG-Icon mit kontrastreicher Farbe.
- Kombiniertes Sprachmenü (Flex + feste Sprachen) statt separatem Modus-Menü.
- "Neues Gespräch"-Button (frische Session gegen Sprach-Trägheit).
- Dark-Mode: lesbare <option>-Popups (Kontrast-Fix).
- Favicon (SVG + PNG-Fallbacks) aus mund.png.
TTS-Backend:
- Sprache wird an alle TTS-Provider durchgereicht; Piper-Stimme folgt der
Sprache; Chatterbox mehrsprachig + cross-lingual.
- Native Referenz-Stimmen je Sprache (config/voices/<lang>.wav, FLEURS CC-BY),
loudness-normalisiert.
LLM-Sprache:
- Antwort folgt zuverlässig der gewählten Sprache (verstärkte Anweisung +
Erinnerung an der letzten Nutzer-Nachricht gegen History-Trägheit).
Admin / Auth:
- Wörterbuch: alle 8 Sprachen, Zeilen editierbar, alphabetische Sortierung.
- Web-UI hinter Auth-Gate (Redirect auf SSO_LOGIN_URL / 401); Favicons offen.
- Log-Tab: Hinweis, wenn der systemd-Dienst nicht aktiv ist.
- Einstellungen: Hinweis "pro Nutzer überschreibbar" bei Sprache/Modus/Qualität.
Doku (BEDIENUNGSANLEITUNG.md): Geräte-TTS §6.5.0, Fix/Flex §6.6, native
Stimmen §6.5.3, llama.cpp<->Ollama-Wechsel §4.7, Auth/SSO §7.4.
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
2026-06-20 13:12:04 +02:00
|
|
|
async def synthesize(self, text, voice=None, audio_format="pcm", language=None):
|
2026-06-17 22:11:20 +02:00
|
|
|
return audio
|
|
|
|
|
monkeypatch.setitem(deps.TTS_REGISTRY, name, lambda s: StubTTS())
|
|
|
|
|
return name
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def test_speak_loopback_collects_chunks(monkeypatch):
|
|
|
|
|
# Stub-TTS liefert b"" -> kein Netzcall; Loopback sammelt den Chunk.
|
|
|
|
|
tts = _stub_tts(monkeypatch)
|
2026-06-17 01:48:56 +02:00
|
|
|
resp = client.post(
|
|
|
|
|
"/api/speak",
|
2026-06-17 22:11:20 +02:00
|
|
|
json={"text": "Hallo Welt", "tts_provider": tts, "output_endpoint": "loopback"},
|
2026-06-17 01:48:56 +02:00
|
|
|
)
|
|
|
|
|
assert resp.status_code == 200
|
|
|
|
|
assert resp.headers["X-Output-Endpoint"] == "loopback"
|
2026-06-17 22:11:20 +02:00
|
|
|
assert resp.headers["X-TTS-Provider"] == tts
|
2026-06-17 01:48:56 +02:00
|
|
|
assert len(loopback_output().chunks) == 1
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def test_unknown_endpoint_returns_422():
|
|
|
|
|
resp = client.post(
|
|
|
|
|
"/api/speak",
|
|
|
|
|
json={"text": "x", "tts_provider": "piper", "output_endpoint": "gibtsnicht"},
|
|
|
|
|
)
|
|
|
|
|
assert resp.status_code == 422
|
|
|
|
|
assert "gibtsnicht" in resp.json()["detail"]
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def test_unknown_provider_returns_422():
|
|
|
|
|
resp = client.post("/api/speak", json={"text": "x", "tts_provider": "gibtsnicht"})
|
|
|
|
|
assert resp.status_code == 422
|
|
|
|
|
|
|
|
|
|
|
2026-06-17 22:11:20 +02:00
|
|
|
def test_session_route_applies(monkeypatch):
|
|
|
|
|
tts = _stub_tts(monkeypatch)
|
2026-06-17 01:48:56 +02:00
|
|
|
client.post(
|
|
|
|
|
"/api/sessions/s1/route",
|
2026-06-17 22:11:20 +02:00
|
|
|
json={"tts_provider": tts, "output_endpoint": "loopback"},
|
2026-06-17 01:48:56 +02:00
|
|
|
)
|
|
|
|
|
resp = client.post("/api/speak?session_id=s1", json={"text": "hallo"})
|
|
|
|
|
assert resp.status_code == 200
|
|
|
|
|
assert resp.headers["X-Output-Endpoint"] == "loopback"
|
2026-06-17 22:11:20 +02:00
|
|
|
assert resp.headers["X-TTS-Provider"] == tts
|
2026-06-17 01:48:56 +02:00
|
|
|
|
|
|
|
|
|
|
|
|
|
def test_chat_per_request_override_and_loopback(monkeypatch):
|
|
|
|
|
class StubLLM:
|
2026-06-19 14:12:16 +02:00
|
|
|
async def complete(self, text, history=None, session_id=None, language=None):
|
2026-06-17 01:48:56 +02:00
|
|
|
return "Mir geht es gut, danke."
|
|
|
|
|
|
|
|
|
|
class StubTTS:
|
feat: Geräte-TTS, native Stimmen, Favicon, Auth-Gate, UI-Fixes
Web-UI / TTS:
- Geräte-TTS ("📱 Gerät"): Antwort wird on-device vorgelesen (Web Speech
API), Server sendet nur Text (text_only) -> spart Bandbreite/Kosten.
Mobil-Default, geräte-lokale Speicherung, iOS-Autoplay-Freischaltung.
- Vorlese-Symbol (🔊) je Bubble: Hybrid-Replay (Assistent-PCM gecacht,
Eingabe via /api/speak); SVG-Icon mit kontrastreicher Farbe.
- Kombiniertes Sprachmenü (Flex + feste Sprachen) statt separatem Modus-Menü.
- "Neues Gespräch"-Button (frische Session gegen Sprach-Trägheit).
- Dark-Mode: lesbare <option>-Popups (Kontrast-Fix).
- Favicon (SVG + PNG-Fallbacks) aus mund.png.
TTS-Backend:
- Sprache wird an alle TTS-Provider durchgereicht; Piper-Stimme folgt der
Sprache; Chatterbox mehrsprachig + cross-lingual.
- Native Referenz-Stimmen je Sprache (config/voices/<lang>.wav, FLEURS CC-BY),
loudness-normalisiert.
LLM-Sprache:
- Antwort folgt zuverlässig der gewählten Sprache (verstärkte Anweisung +
Erinnerung an der letzten Nutzer-Nachricht gegen History-Trägheit).
Admin / Auth:
- Wörterbuch: alle 8 Sprachen, Zeilen editierbar, alphabetische Sortierung.
- Web-UI hinter Auth-Gate (Redirect auf SSO_LOGIN_URL / 401); Favicons offen.
- Log-Tab: Hinweis, wenn der systemd-Dienst nicht aktiv ist.
- Einstellungen: Hinweis "pro Nutzer überschreibbar" bei Sprache/Modus/Qualität.
Doku (BEDIENUNGSANLEITUNG.md): Geräte-TTS §6.5.0, Fix/Flex §6.6, native
Stimmen §6.5.3, llama.cpp<->Ollama-Wechsel §4.7, Auth/SSO §7.4.
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
2026-06-20 13:12:04 +02:00
|
|
|
async def synthesize(self, text, voice=None, audio_format="pcm", language=None):
|
2026-06-17 01:48:56 +02:00
|
|
|
return b"AUDIO"
|
|
|
|
|
|
|
|
|
|
monkeypatch.setitem(deps.LLM_REGISTRY, "stub", lambda s: StubLLM())
|
|
|
|
|
monkeypatch.setitem(deps.TTS_REGISTRY, "stub", lambda s: StubTTS())
|
|
|
|
|
|
|
|
|
|
resp = client.post(
|
|
|
|
|
"/api/chat?debug=true",
|
|
|
|
|
json={
|
|
|
|
|
"text": "Wie geht es dir?",
|
|
|
|
|
"llm_provider": "stub",
|
|
|
|
|
"tts_provider": "stub",
|
|
|
|
|
"output_endpoint": "loopback",
|
|
|
|
|
},
|
|
|
|
|
)
|
|
|
|
|
assert resp.status_code == 200
|
|
|
|
|
body = resp.json()
|
|
|
|
|
assert body["route"]["llm_provider"] == "stub"
|
|
|
|
|
assert body["route"]["output_endpoint"] == "loopback"
|
|
|
|
|
assert body["trace"]["semantic_response"] == "Mir geht es gut, danke."
|
|
|
|
|
assert loopback_output().chunks[0].data == b"AUDIO"
|
|
|
|
|
|
|
|
|
|
|
2026-06-17 11:28:20 +02:00
|
|
|
def test_transcribe_with_stub_stt(monkeypatch):
|
|
|
|
|
class StubSTT:
|
|
|
|
|
async def transcribe(self, audio_bytes, fmt, language=None):
|
|
|
|
|
return "erkannter text"
|
|
|
|
|
|
|
|
|
|
monkeypatch.setitem(deps.STT_REGISTRY, "stub-stt", lambda s: StubSTT())
|
2026-06-17 01:48:56 +02:00
|
|
|
files = {"file": ("a.wav", b"RIFFdata", "audio/wav")}
|
2026-06-17 11:28:20 +02:00
|
|
|
data = {"stt_provider": "stub-stt"}
|
2026-06-17 01:48:56 +02:00
|
|
|
resp = client.post("/api/transcribe", data=data, files=files)
|
|
|
|
|
assert resp.status_code == 200
|
|
|
|
|
body = resp.json()
|
2026-06-17 11:28:20 +02:00
|
|
|
assert body["route"]["stt_provider"] == "stub-stt"
|
|
|
|
|
assert body["trace"]["raw_transcript"] == "erkannter text"
|
2026-06-17 01:48:56 +02:00
|
|
|
|
|
|
|
|
|
|
|
|
|
def test_config_endpoint_exposes_no_secrets():
|
|
|
|
|
resp = client.get("/api/config")
|
|
|
|
|
assert resp.status_code == 200
|
|
|
|
|
body = resp.json()
|
|
|
|
|
assert "piper" in body["available"]["tts_providers"]
|
|
|
|
|
assert "loopback" in {e["kind"] for e in body["available"]["output_endpoints"]}
|
|
|
|
|
# Keine echten Secrets im Body.
|
|
|
|
|
assert "sk-or-" not in json.dumps(body)
|
|
|
|
|
assert set(body["secrets"].keys()) == {"openrouter_api_key_set"}
|