AudioVideoClips logoAudioVideoClips

🎙️Pocket TTS Voice

Kyutai-Stimmgenerator in 5 Sprachen, auf dem Gerät. Gratis, privat, ohne Anmeldung — Dateien verlassen deinen Browser nie.

Pocket TTS by Kyutai (100M params, built-in preset voices) — models download once, then run on-device. Custom voice cloning is disabled to prevent misuse. Web runtime adapted from KevinAHM's demo (Apache-2.0).

Fünf Sprachen. Preset-Stimmen. Null Server.

Kyutai Pocket TTS mit eingebauten Preset-Stimmen, Streaming direkt von deinem Gerät. Kein Upload, keine Anmeldung, kein Wasserzeichen.

5
Sprachen
EN, DE, IT, PT, ES
8
Stimmen je
eingebaute Stimm-Presets
0
Uploads
100 % ONNX im Browser
Free
für immer
keine Anmeldung

So benutzt du Pocket TTS Voice

Wähle aus 8 eingebauten Preset-Stimmen pro Sprache – Englisch, Deutsch, Italienisch, Portugiesisch oder Spanisch – und erzeuge natürliche Sprache mit Streaming-Synthese niedriger Latenz. Nur Preset-Stimmen: Kloning ist deaktiviert, um Missbrauch zu verhindern. Modelle werden einmal geladen und zwischengespeichert; danach ist alles sofort und privat.

  1. 1Tippe oder füge bis zu 2000 Zeichen ein.
  2. 2Wähle eine Sprache und eine eingebaute Stimme.
  3. 3Klicke auf Generieren und lade das WAV-Voice-over.

Anwendungsfälle

Mehrsprachige Voice-overs
Erzähle Reels und Erklärvideos in fünf Sprachen mit konsistenten Stimmen.
Charakterstimmen
Gib jeder Figur eine eigene Preset-Stimme für Geschichten und Spiele.
Barrierefreiheit
Verwandle Artikel und Notizen mit einem Klick in hörbares Audio.

Was Pocket TTS Voice kann

Details

Speed
~6x Echtzeit auf CPU, Streaming
Input
Text bis zu 2000 Zeichen
Output
WAV-Voice-over (24 kHz)
Privacy
ONNX auf dem Gerät, null Uploads
Cost
Kostenlos, unbegrenzt, ohne Anmeldung

Häufige Fragen

Wird mein Text an einen Server gesendet?

Nein. Pocket TTS läuft zu 100 % in deinem Browser per ONNX. Dein Text verlässt dein Gerät nie.

Welche Sprachen und Stimmen gibt es?

Fünf Sprachen (Englisch, Deutsch, Italienisch, Portugiesisch, Spanisch), jede mit 8 eingebauten Stimmen.

Warum dauert der erste Durchlauf länger?

Die Stimmmodelle werden einmal geladen und von deinem Browser zwischengespeichert. Jeder Durchlauf danach startet schneller.

Was ist das Download-Format?

Ein 24-kHz-WAV-Voice-over, das du in jeden Video- oder Podcast-Editor ziehen kannst.

Mehr Gratis-Tools

Mehr Kontrolle nötig? Öffne den kompletten Video- + Audio-Editor →