docs: Cloud-TTS-Stimmen (OpenRouter) dokumentieren + Umstellen
BEDIENUNGSANLEITUNG (B1): neuer Abschnitt 'Stimme des Cloud-TTS (OpenRouter) waehlen' -- Gateway pflegt keine eigene Liste, reicht OPENROUTER_TTS_VOICE durch; Stimmen haengen vom Modell ab (Gemini-Familie ~30 Stimmen, OpenAI gpt-4o-mini-tts), Umstellen global (.env) und pro Aufruf (voice-Feld in /api/speak,/api/chat), Hinweis auf fehlende --voice-Option in voice_loop. .env.example: Verweis bei OPENROUTER_TTS_VOICE. Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
This commit is contained in:
parent
d4de9ba5b0
commit
a40ae75c5f
2 changed files with 34 additions and 0 deletions
|
|
@ -294,6 +294,38 @@ und Abkürzungen („Dr." → „Doktor", „z. B." → „zum Beispiel"). Reine
|
|||
```
|
||||
Danach den Server einmal neu starten.
|
||||
|
||||
**Stimme des Cloud-TTS (OpenRouter) wählen:** Das Gateway pflegt **keine** eigene
|
||||
Stimmenliste — es reicht den Namen aus `OPENROUTER_TTS_VOICE` unverändert an OpenRouter
|
||||
weiter. Welche Stimmen gültig sind, bestimmt das gewählte **TTS-Modell**
|
||||
(`OPENROUTER_TTS_MODEL`). Aktuell aktiv: Modell `google/gemini-3.1-flash-tts-preview`,
|
||||
Stimme `Zephyr`.
|
||||
|
||||
Verfügbare Stimmen je Modell (laut Anbieter-Doku — Preview, im Zweifel ausprobieren):
|
||||
- **Gemini-TTS** (aktiv) — ~30 mehrsprachige Stimmen, u. a. `Zephyr`, `Puck`, `Charon`,
|
||||
`Kore`, `Fenrir`, `Leda`, `Orus`, `Aoede`, `Callirrhoe`, `Autonoe`, `Enceladus`,
|
||||
`Iapetus`, `Umbriel`, `Algieba`, `Despina`, `Erinome`, `Algenib`, `Rasalgethi`,
|
||||
`Laomedeia`, `Achernar`, `Alnilam`, `Schedar`, `Gacrux`, `Pulcherrima`, `Achird`,
|
||||
`Zubenelgenubi`, `Vindemiatrix`, `Sadachbia`, `Sadaltager`, `Sulafat`.
|
||||
- **OpenAI `gpt-4o-mini-tts`** (Code-/TOML-Default) — `alloy`, `ash`, `ballad`, `coral`,
|
||||
`echo`, `fable`, `nova`, `onyx`, `sage`, `shimmer`, `verse`.
|
||||
|
||||
> Es gibt keinen Endpoint, der TTS-Stimmen auflistet, und die Modelle sind Preview.
|
||||
> **Authentischster Test:** Stimme setzen und probieren — ein ungültiger Name liefert
|
||||
> einen OpenRouter-Fehler (HTTP 502 mit Klartext, der oft die gültigen Stimmen nennt).
|
||||
|
||||
Umstellen:
|
||||
```bash
|
||||
# global (dann Server neu starten):
|
||||
echo 'OPENROUTER_TTS_VOICE=Puck' >> .env
|
||||
# pro Aufruf (überschreibt den Default für genau diesen Request):
|
||||
curl -s -X POST "$URL/api/speak" -H 'Content-Type: application/json' \
|
||||
-d '{"text":"Probe","voice":"Kore","tts_provider":"openrouter"}' --output probe.pcm
|
||||
# anderes TTS-Modell (andere Stimmenfamilie):
|
||||
echo 'OPENROUTER_TTS_MODEL=openai/gpt-4o-mini-tts' >> .env
|
||||
```
|
||||
Das Feld `voice` gibt es im Body von `/api/speak` und `/api/chat`. Hinweis:
|
||||
`scripts/voice_loop.py` hat **keine** `--voice`-Option — dort gilt der Server-Default.
|
||||
|
||||
## B2. Soundquelle & Ausgabe-Gerät wechseln (Mikrofon, Lautsprecher, Bluetooth, Handy)
|
||||
|
||||
> **Wichtig — aktueller Stand:** Die Geräte-Endpunkte **im Gateway**
|
||||
|
|
|
|||
Loading…
Add table
Add a link
Reference in a new issue