terms-Matching jetzt case-insensitiv (Aussprache ist case-egal -> ein Eintrag deckt auch Satzanfaenge ab). config/pronunciation.de.yaml mit per espeak-ng verifizierten Korrekturen gefuellt: stroemt/stroemte/loest/toent/blaest/buesst/ gruesst/Mond -> lange Vokale (h-Umschreibung). Kontrolle: loescht/waescht/stroemst bleiben korrekt unangetastet. Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
34 lines
1.2 KiB
YAML
34 lines
1.2 KiB
YAML
# Aussprache-Lexikon (Deutsch) für die TTS-Normalisierung vor Piper.
|
||
#
|
||
# Dies ist das GRUNDGERÜST – Inhalte werden später schrittweise ergänzt.
|
||
# Einträge hier ERWEITERN/ÜBERSCHREIBEN die eingebauten Defaults des Normalizers.
|
||
# Wirkt nur bei lokalem TTS (piper, Stufe "full"); Cloud-TTS bleibt unangetastet.
|
||
#
|
||
# Format:
|
||
# abbreviations: ganze Token werden wortgrenzen-sicher ersetzt (Punkt mitschreiben!)
|
||
# units: werden nur DIREKT NACH EINER ZAHL ersetzt (z. B. "10 kg")
|
||
# terms: Fachwörter / Eigennamen / englische Begriffe
|
||
#
|
||
# Beispiele (auskommentiert – bei Bedarf aktivieren/ergänzen):
|
||
|
||
abbreviations:
|
||
# "ggf.": "gegebenenfalls"
|
||
# "inkl.": "inklusive"
|
||
|
||
units:
|
||
# "kWh": "Kilowattstunden"
|
||
|
||
# Aussprache-Korrekturen: espeak-ng (in Piper) verkürzt bei einigen Wortformen
|
||
# fälschlich einen langen Vokal. Umschreibung mit "h" -> langer Vokal.
|
||
# Alle Einträge mit `espeak-ng -v de -x "<wort>"` verifiziert (Y:/E:/o: = lang).
|
||
# Matching ist case-insensitiv (deckt auch Satzanfänge ab).
|
||
terms:
|
||
"strömt": "ströhmt"
|
||
"strömte": "ströhmte"
|
||
"löst": "löhst"
|
||
"tönt": "töhnt"
|
||
"bläst": "blähst"
|
||
"büßt": "bühßt"
|
||
"grüßt": "grühßt"
|
||
"Mond": "Mohnd"
|
||
# "Linux": "Linuks" # Beispiel für Eigennamen/IT-Begriffe
|