← Zurück zu allen Neuigkeiten
29. Juni 2026

Thorsten-Voice ❤️ CosyVoice3

Ich habe die vergangenen Monate an einem neuen freien Thorsten-Voice TTS-Modell gearbeitet. Wie immer kostenlos, offen lizenziert und vollständig lokal nutzbar, ohne Cloud und ohne Datenweitergabe.

Nach Coqui und Piper setze ich diesmal auf CosyVoice3 als Grundlage. Es nutzt ein modernes LLM-basiertes TTS-System von FunAudioLLM, das besonders natürliche Prosodie und Sprechrhythmus erzeugt.

Das Modell steht auf drei Wegen zur Verfügung:

  1. Modell auf HuggingFace für eigene Projekte und Finetuning
  2. HuggingFace Space direkt im Browser ausprobieren, keine Installation nötig
  3. Docker Image auf Docker Hub — ein Befehl, läuft lokal

Weitere Details zu meinem CosyVoice3-Modell und zur Einrichtung/Nutzung des Docker-Container-Images findest du auf den oben verlinkten Seiten.

Viel Spaß damit! Feedback wie immer willkommen.