← Zurück zu allen Neuigkeiten
27. Februar 2026
Thorsten-Voice Datensätze jetzt auch im Mozilla Data Collective
Alle meine Thorsten-Voice Sprachdatensätze sind jetzt auch über das Mozilla Data Collective (MDC) verfügbar. Dazu gehören:
- TV-2021.02-Neutral
- TV-2022.10-Neutral
- TV-2021.06-Emotional
- TV-2023.09-Hessisch
- TV-44kHz-Full (ca. 40 Stunden, 38.000+ Aufnahmen)
Die Datensätze bleiben unter der CC0-Lizenz (Public Domain) freigegeben und sind sowohl für Forschung als auch für kommerzielle Anwendungen frei nutzbar.
Das Mozilla Data Collective ist damit — neben Zenodo und Hugging Face — ein weiterer offener Verteilungskanal, der die Zugänglichkeit und langfristige Verfügbarkeit zusätzlich erhöht.
Das Ziel von Thorsten-Voice bleibt unverändert: hochwertige deutsche Sprachdatensätze als offene Ressource für Forschung, Entwicklung und Innovation im Bereich Text-to-Speech bereitzustellen.
Danke auch an die Mozilla Foundation für den netten LinkedIn-Beitrag dazu.