diff --git a/BEDIENUNGSANLEITUNG.md b/BEDIENUNGSANLEITUNG.md index b525777..6f82b1d 100644 --- a/BEDIENUNGSANLEITUNG.md +++ b/BEDIENUNGSANLEITUNG.md @@ -341,6 +341,44 @@ curl -s $URL/api/metrics | jq '.timers | to_entries Empfehlung für den Einstieg: **`cloud`** verwenden, Antwortzeiten mit C2 prüfen, dann bei Bedarf einzelne Module umstellen (Teil B1). +### C4. Empfohlene Top-Konstellation (reproduzierbar) + +Bewährte Konstellation mit sehr guter Sprachqualität (beherrscht u. a. **Plattdeutsch**) — +**alles remote über OpenRouter** (Profil `cloud`), nichts lokal: + +| Stufe | Modell | Anbieter | +|------|--------|----------| +| STT | `openai/whisper-large-v3` | OpenRouter (remote) | +| LLM | `google/gemini-3.1-flash-lite` | OpenRouter (remote) | +| TTS | `google/gemini-3.1-flash-tts-preview` (Stimme `Zephyr`) | OpenRouter (remote) | + +So reproduzierst du sie — in `.env`: +``` +VA_PROFILE=cloud +OPENROUTER_STT_MODEL=openai/whisper-large-v3 +OPENROUTER_LLM_MODEL=google/gemini-3.1-flash-lite +OPENROUTER_TTS_MODEL=google/gemini-3.1-flash-tts-preview +OPENROUTER_TTS_VOICE=Zephyr +``` +Key via Umgebung (`OPENROUTER_API_KEY`). Dann ohne Provider-Overrides starten: +```bash +make run +python scripts/voice_loop.py --recorder arecord --device plughw:5,0 --session test +``` + +**Grobe Kosten (Daumenwert, am OpenRouter-Dashboard verifizieren — Preise ändern sich):** + +| Stufe | Annahme | ~Kosten/Runde | +|------|---------|---------------| +| STT (Whisper) | ~$0,006/Audio-Min, ~15 s | ~0,15 ¢ | +| LLM (Flash-Lite) | ~800 in / ~150 out Tokens | ~0,01 ¢ (vernachlässigbar) | +| TTS (Flash-TTS) | ~$0,01–0,03/Audio-Min, ~30 s | ~0,5–1,5 ¢ | +| **Summe** | | **≈ 1–2 ¢ pro Sprech-Runde** | + +→ grob **~20–40 ¢ pro 10-Minuten-Gespräch**, **~1–2 $/Stunde**. Kostentreiber ist das +**Audio (TTS, dann STT)**; das LLM ist nahezu kostenlos. Verlässliche Zahlen liefert das +**OpenRouter-Dashboard** (Activity/Usage). + --- # Betrieb & Verwaltung