feat(tts): Aussprache-Lexikon befüllt (verifizierte Vokallängen-Fixes) + case-insensitiv

terms-Matching jetzt case-insensitiv (Aussprache ist case-egal -> ein Eintrag
deckt auch Satzanfaenge ab). config/pronunciation.de.yaml mit per espeak-ng
verifizierten Korrekturen gefuellt: stroemt/stroemte/loest/toent/blaest/buesst/
gruesst/Mond -> lange Vokale (h-Umschreibung). Kontrolle: loescht/waescht/stroemst
bleiben korrekt unangetastet.

Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
This commit is contained in:
Dieter Schlüter 2026-06-17 23:19:17 +02:00
commit 449a62a88e
3 changed files with 30 additions and 6 deletions

View file

@ -18,6 +18,17 @@ abbreviations:
units:
# "kWh": "Kilowattstunden"
# Aussprache-Korrekturen: espeak-ng (in Piper) verkürzt bei einigen Wortformen
# fälschlich einen langen Vokal. Umschreibung mit "h" -> langer Vokal.
# Alle Einträge mit `espeak-ng -v de -x "<wort>"` verifiziert (Y:/E:/o: = lang).
# Matching ist case-insensitiv (deckt auch Satzanfänge ab).
terms:
# "Linux": "Linuks"
# "CPU": "C P U"
"strömt": "ströhmt"
"strömte": "ströhmte"
"löst": "löhst"
"tönt": "töhnt"
"bläst": "blähst"
"büßt": "bühßt"
"grüßt": "grühßt"
"Mond": "Mohnd"
# "Linux": "Linuks" # Beispiel für Eigennamen/IT-Begriffe