From d4de9ba5b069060c0bedefbd00f368fb94949830 Mon Sep 17 00:00:00 2001 From: =?UTF-8?q?Dieter=20Schl=C3=BCter?= Date: Wed, 17 Jun 2026 23:31:58 +0200 Subject: [PATCH] docs: installierte Piper-Stimmen auflisten + download-Hinweis korrigieren BEDIENUNGSANLEITUNG: Tabelle der aktuell installierten Stimmen (DE/EN/ES/FR, Qualitaet, Default thorsten-high), Hinweis auf fehlende weibliche DE-high-Stimme und dass chatterbox noch Stub ist. .env.example: nicht funktionierenden 'python -m piper.download_voices'-Befehl durch ls + huggingface-Hinweis ersetzt. Co-Authored-By: Claude Opus 4.8 --- .env.example | 3 ++- BEDIENUNGSANLEITUNG.md | 16 ++++++++++++++++ 2 files changed, 18 insertions(+), 1 deletion(-) diff --git a/.env.example b/.env.example index 43ccce8..4b86bec 100644 --- a/.env.example +++ b/.env.example @@ -55,7 +55,8 @@ FASTER_WHISPER_COMPUTE_TYPE=default # default|int8|float16|int8_float16 # --- Lokales TTS (piper; Binary + Stimmmodell noetig) ------------------------ # Aktivieren z. B. mit DEFAULT_TTS_PROVIDER=piper (oder --tts-provider piper). # Stimmen liegen als .onnx (+ .onnx.json) im Voices-Verzeichnis. -# Modelle laden: python -m piper.download_voices de_DE-thorsten-high (o. manuell). +# Installierte Stimmen anzeigen: ls ~/.local/share/piper/voices/*.onnx +# Weitere laden: von huggingface 'rhasspy/piper-voices' nach PIPER_VOICES_DIR kopieren. PIPER_BIN=piper # Pfad/Name des piper-Binaries PIPER_VOICES_DIR=~/.local/share/piper/voices # Verzeichnis der .onnx-Stimmen PIPER_VOICE=de_DE-thorsten-high # Stimmmodell (ohne .onnx) oder voller Pfad diff --git a/BEDIENUNGSANLEITUNG.md b/BEDIENUNGSANLEITUNG.md index be63467..0ca8c8b 100644 --- a/BEDIENUNGSANLEITUNG.md +++ b/BEDIENUNGSANLEITUNG.md @@ -261,6 +261,22 @@ piper-Stimme/Verzeichnis steuern `PIPER_VOICE`/`PIPER_VOICES_DIR` in `.env` (Def aber **nichts** und verlässt den Rechner nie. Liefert eine Stimme nicht 24000 Hz (z. B. `de_DE-thorsten-high` = 22050 Hz), resampelt das Gateway automatisch per `ffmpeg`. +**Aktuell installierte Stimmen** (jederzeit prüfen mit `ls ~/.local/share/piper/voices/*.onnx`): + +| `PIPER_VOICE` | Sprache | Qualität | Hinweis | +|---|---|---|---| +| `de_DE-thorsten-high` | Deutsch | high (22050 Hz) | **Default**, männlich | +| `de_DE-kerstin-low` | Deutsch | low (16000 Hz) | weiblich, hörbar gröber | +| `en_US-ryan-high` | English | high | | +| `es_ES-davefx-medium` | Español | medium | | +| `fr_FR-gilles-low` | Français | low | | + +Für Deutsch gibt es bisher nur diese zwei Stimmen; eine **weibliche** Stimme in +`high`/`medium`-Qualität fehlt. Weitere Stimmen von huggingface `rhasspy/piper-voices` +laden (je `.onnx` + `.onnx.json` nach `PIPER_VOICES_DIR`), dann `PIPER_VOICE` +setzen und den Server neu starten. **Chatterbox** (ResembleAI) ist im Gateway noch ein +Stub und damit nicht als TTS nutzbar. + **Aussprache verbessern (nur lokales TTS):** Vor Piper läuft ein Normalizer, der typische Stolpersteine glättet — Ordinalzahlen („1. Mai" → „erster Mai", „1. 2. 3." → „erstens, zweitens, drittens"), Einheiten („10 kg" → „… Kilogramm", „km/h" → „Kilometer pro Stunde")