docs: Cloud-TTS-Stimmen (OpenRouter) dokumentieren + Umstellen
BEDIENUNGSANLEITUNG (B1): neuer Abschnitt 'Stimme des Cloud-TTS (OpenRouter) waehlen' -- Gateway pflegt keine eigene Liste, reicht OPENROUTER_TTS_VOICE durch; Stimmen haengen vom Modell ab (Gemini-Familie ~30 Stimmen, OpenAI gpt-4o-mini-tts), Umstellen global (.env) und pro Aufruf (voice-Feld in /api/speak,/api/chat), Hinweis auf fehlende --voice-Option in voice_loop. .env.example: Verweis bei OPENROUTER_TTS_VOICE. Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
This commit is contained in:
parent
d4de9ba5b0
commit
a40ae75c5f
2 changed files with 34 additions and 0 deletions
|
|
@ -34,6 +34,8 @@ VA_PROFILE=
|
||||||
# Zeilen unten ueberschreiben daher ein gesetztes VA_PROFILE. Wer profilbasiert
|
# Zeilen unten ueberschreiben daher ein gesetztes VA_PROFILE. Wer profilbasiert
|
||||||
# umschalten will, sollte sie auskommentiert lassen.
|
# umschalten will, sollte sie auskommentiert lassen.
|
||||||
OPENROUTER_STT_MODEL=openai/whisper-large-v3
|
OPENROUTER_STT_MODEL=openai/whisper-large-v3
|
||||||
|
# Stimme haengt vom Modell ab (Gemini: Zephyr/Puck/Kore/...; OpenAI: alloy/echo/nova/...).
|
||||||
|
# Stimmenliste + Umstellen pro Aufruf: siehe BEDIENUNGSANLEITUNG ("Stimme des Cloud-TTS").
|
||||||
OPENROUTER_TTS_MODEL=openai/gpt-4o-mini-tts
|
OPENROUTER_TTS_MODEL=openai/gpt-4o-mini-tts
|
||||||
OPENROUTER_TTS_VOICE=alloy
|
OPENROUTER_TTS_VOICE=alloy
|
||||||
OPENROUTER_LLM_MODEL=openai/gpt-4.1-mini
|
OPENROUTER_LLM_MODEL=openai/gpt-4.1-mini
|
||||||
|
|
|
||||||
|
|
@ -294,6 +294,38 @@ und Abkürzungen („Dr." → „Doktor", „z. B." → „zum Beispiel"). Reine
|
||||||
```
|
```
|
||||||
Danach den Server einmal neu starten.
|
Danach den Server einmal neu starten.
|
||||||
|
|
||||||
|
**Stimme des Cloud-TTS (OpenRouter) wählen:** Das Gateway pflegt **keine** eigene
|
||||||
|
Stimmenliste — es reicht den Namen aus `OPENROUTER_TTS_VOICE` unverändert an OpenRouter
|
||||||
|
weiter. Welche Stimmen gültig sind, bestimmt das gewählte **TTS-Modell**
|
||||||
|
(`OPENROUTER_TTS_MODEL`). Aktuell aktiv: Modell `google/gemini-3.1-flash-tts-preview`,
|
||||||
|
Stimme `Zephyr`.
|
||||||
|
|
||||||
|
Verfügbare Stimmen je Modell (laut Anbieter-Doku — Preview, im Zweifel ausprobieren):
|
||||||
|
- **Gemini-TTS** (aktiv) — ~30 mehrsprachige Stimmen, u. a. `Zephyr`, `Puck`, `Charon`,
|
||||||
|
`Kore`, `Fenrir`, `Leda`, `Orus`, `Aoede`, `Callirrhoe`, `Autonoe`, `Enceladus`,
|
||||||
|
`Iapetus`, `Umbriel`, `Algieba`, `Despina`, `Erinome`, `Algenib`, `Rasalgethi`,
|
||||||
|
`Laomedeia`, `Achernar`, `Alnilam`, `Schedar`, `Gacrux`, `Pulcherrima`, `Achird`,
|
||||||
|
`Zubenelgenubi`, `Vindemiatrix`, `Sadachbia`, `Sadaltager`, `Sulafat`.
|
||||||
|
- **OpenAI `gpt-4o-mini-tts`** (Code-/TOML-Default) — `alloy`, `ash`, `ballad`, `coral`,
|
||||||
|
`echo`, `fable`, `nova`, `onyx`, `sage`, `shimmer`, `verse`.
|
||||||
|
|
||||||
|
> Es gibt keinen Endpoint, der TTS-Stimmen auflistet, und die Modelle sind Preview.
|
||||||
|
> **Authentischster Test:** Stimme setzen und probieren — ein ungültiger Name liefert
|
||||||
|
> einen OpenRouter-Fehler (HTTP 502 mit Klartext, der oft die gültigen Stimmen nennt).
|
||||||
|
|
||||||
|
Umstellen:
|
||||||
|
```bash
|
||||||
|
# global (dann Server neu starten):
|
||||||
|
echo 'OPENROUTER_TTS_VOICE=Puck' >> .env
|
||||||
|
# pro Aufruf (überschreibt den Default für genau diesen Request):
|
||||||
|
curl -s -X POST "$URL/api/speak" -H 'Content-Type: application/json' \
|
||||||
|
-d '{"text":"Probe","voice":"Kore","tts_provider":"openrouter"}' --output probe.pcm
|
||||||
|
# anderes TTS-Modell (andere Stimmenfamilie):
|
||||||
|
echo 'OPENROUTER_TTS_MODEL=openai/gpt-4o-mini-tts' >> .env
|
||||||
|
```
|
||||||
|
Das Feld `voice` gibt es im Body von `/api/speak` und `/api/chat`. Hinweis:
|
||||||
|
`scripts/voice_loop.py` hat **keine** `--voice`-Option — dort gilt der Server-Default.
|
||||||
|
|
||||||
## B2. Soundquelle & Ausgabe-Gerät wechseln (Mikrofon, Lautsprecher, Bluetooth, Handy)
|
## B2. Soundquelle & Ausgabe-Gerät wechseln (Mikrofon, Lautsprecher, Bluetooth, Handy)
|
||||||
|
|
||||||
> **Wichtig — aktueller Stand:** Die Geräte-Endpunkte **im Gateway**
|
> **Wichtig — aktueller Stand:** Die Geräte-Endpunkte **im Gateway**
|
||||||
|
|
|
||||||
Loading…
Add table
Add a link
Reference in a new issue