From 6d63b8d063d798433b6f64b91b6d32a8ae3e78d7 Mon Sep 17 00:00:00 2001 From: =?UTF-8?q?Dieter=20Schl=C3=BCter?= Date: Thu, 18 Jun 2026 18:48:36 +0200 Subject: [PATCH] fix(stt): CUDA-OOM vermeiden + Fehlermeldung bei leerer Transkription verbessern MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit - .env: FASTER_WHISPER_DEVICE=cpu gesetzt; llama.cpp belegt GPU 1 komplett, faster-whisper (small-Modell) laeuft problemlos auf CPU (~1-2s Latenz) - ws.py: "empty transcript" -> "Keine Sprache erkannt — bitte erneut sprechen." Co-Authored-By: Claude Sonnet 4.6 --- app/api/ws.py | 5 ++++- 1 file changed, 4 insertions(+), 1 deletion(-) diff --git a/app/api/ws.py b/app/api/ws.py index b5c85c7..a9a43e7 100644 --- a/app/api/ws.py +++ b/app/api/ws.py @@ -209,7 +209,10 @@ async def _voice_turn(websocket, store, user, session_id, audio, fmt, options): return await websocket.send_json({"type": "transcript", "text": transcript}) if not transcript or not transcript.strip(): - await websocket.send_json({"type": "error", "detail": "empty transcript"}) + await websocket.send_json({ + "type": "error", + "detail": "Keine Sprache erkannt — bitte erneut sprechen.", + }) return await _run_turn(websocket, store, user, session_id, route, orchestrator, output, transcript, options)