← Zurück zu allen Neuigkeiten
27. Februar 2026

Thorsten-Voice Datensätze jetzt auch im Mozilla Data Collective

Alle meine Thorsten-Voice Sprachdatensätze sind jetzt auch über das Mozilla Data Collective (MDC) verfügbar. Dazu gehören:

Die Datensätze bleiben unter der CC0-Lizenz (Public Domain) freigegeben und sind sowohl für Forschung als auch für kommerzielle Anwendungen frei nutzbar.

Das Mozilla Data Collective ist damit — neben Zenodo und Hugging Face — ein weiterer offener Verteilungskanal, der die Zugänglichkeit und langfristige Verfügbarkeit zusätzlich erhöht.

Das Ziel von Thorsten-Voice bleibt unverändert: hochwertige deutsche Sprachdatensätze als offene Ressource für Forschung, Entwicklung und Innovation im Bereich Text-to-Speech bereitzustellen.

Danke auch an die Mozilla Foundation für den netten LinkedIn-Beitrag dazu.