🎙️Pocket TTS Voice
Générateur vocal Kyutai en 5 langues, sur l’appareil. Gratuit, privé, sans inscription — vos fichiers ne quittent jamais le navigateur.
Pocket TTS by Kyutai (100M params, built-in preset voices) — models download once, then run on-device. Custom voice cloning is disabled to prevent misuse. Web runtime adapted from KevinAHM's demo (Apache-2.0).
Des voix prêtes. Cinq langues. Zéro serveur.
Kyutai Pocket TTS avec voix prédéfinies, en streaming depuis votre propre appareil. Ni envoi, ni inscription, ni filigrane.
Comment utiliser Pocket TTS Voice
Transformez du texte en parole avec des voix intégrées. Choisissez parmi 8 voix prédéfinies par langue — anglais, allemand, italien, portugais ou espagnol — et générez une parole naturelle avec synthèse streaming à faible latence. Voix prédéfinies uniquement ; le clonage est désactivé pour prévenir tout usage abusif. Les modèles se téléchargent une fois puis restent en cache ; ensuite tout est instantané et privé.
- 1Saisissez ou collez jusqu’à 2000 caractères.
- 2Choisissez une langue et une voix intégrée.
- 3Appuyez sur Générer et téléchargez la voix off en WAV.
Cas d’usage
Ce que Pocket TTS Voice fait
- ✓8 voix prédéfinies intégrées par langue.
- ✓Cinq langues : anglais, allemand, italien, portugais, espagnol.
- ✓Synthèse en streaming avec ~200ms jusqu’au premier audio.
- ✓Téléchargement WAV haute qualité en 24 kHz pour les éditeurs.
- ✓ONNX entièrement local : ni envois, ni comptes, ni filigranes.
Caractéristiques
- Speed
- Environ 6x temps réel sur CPU, en streaming
- Input
- Texte jusqu’à 2000 caractères
- Output
- Voix off WAV (24 kHz)
- Privacy
- ONNX local, zéro envoi
- Cost
- Gratuit, illimité, sans inscription
Questions fréquentes
Mon texte est-il envoyé à un serveur ?
Non. Pocket TTS tourne à 100 % dans votre navigateur via ONNX. Votre texte ne quitte jamais votre appareil.
Quelles langues et voix sont disponibles ?
Cinq langues (anglais, allemand, italien, portugais, espagnol), chacune avec 8 voix intégrées.
Pourquoi la première fois est-elle plus longue ?
Les modèles vocaux se téléchargent une fois puis restent dans le cache du navigateur. Ensuite chaque génération démarre plus vite.
Quel est le format du téléchargement ?
Un fichier voix off WAV en 24 kHz à utiliser dans tout éditeur vidéo ou podcast.