# Native Referenz-Stimmen (Chatterbox cross-lingual) Je Sprache eine kurze Referenz-WAV (~6–8 s). Der Chatterbox-TTS-Provider wählt sie automatisch nach der Antwortsprache aus (Konvention `.wav`, siehe `CHATTERBOX_VOICES_DIR`). Das Timbre der Referenz wird cross-lingual auf die jeweilige Sprache übertragen. Fehlt eine Datei, greift `CHATTERBOX_VOICE` (persönlicher Klon) bzw. die Standardstimme des Dienstes. Deutsch (`de`) hat bewusst **keine** Datei hier — dafür gilt der persönliche Klon aus `CHATTERBOX_VOICE`. ## Quelle & Lizenz Die Clips stammen aus dem **FLEURS**-Datensatz (Google), Split `validation`: | Datei | FLEURS-Config | Sprache | |-------|---------------|---------| | en.wav | en_us | Englisch (US) | | fr.wav | fr_fr | Französisch | | es.wav | es_419 | Spanisch (Lateinamerika) | | it.wav | it_it | Italienisch | | nl.wav | nl_nl | Niederländisch | | ru.wav | ru_ru | Russisch | | zh.wav | cmn_hans_cn | Mandarin-Chinesisch | Die Clips wurden auf einheitliche Lautheit normalisiert (EBU R128, `loudnorm` I=-16 LUFS, TP=-1.5 dB) — die FLEURS-Originalpegel waren stark uneinheitlich (z. B. ru/en/nl deutlich zu leise). Nur Pegelanpassung, kein inhaltlicher Eingriff. **Lizenz: CC-BY 4.0** — Namensnennung erforderlich. > FLEURS: Conneau et al., "FLEURS: Few-shot Learning Evaluation of Universal > Representations of Speech" (Google Research). Datensatz: `google/fleurs` > auf Hugging Face. Lizenz: Creative Commons Attribution 4.0 (CC-BY 4.0). Zum Austauschen einfach eine andere `.wav` ablegen (Pfad muss für den Chatterbox-Dienst lesbar sein; der Provider löst ihn absolut auf).