💬Audio to Text
Trascrivi il parlato in testo + sottotitoli SRT. Gratis, privato, senza registrazione — i file non lasciano mai il tuo browser.
First run downloads the AI speech model once (~40MB), then it’s fast. 100% private — on-device.
Parole dette, parole scritte, con timestamp.
L’AI sul dispositivo ascolta audio o video e scrive ogni parola, con orari trasformabili in sottotitoli. Nulla viene caricato.
Come usare Audio to Text
Trasforma le parole parlate in testo scritto. Trascina un file audio o video e l’AI sul dispositivo scrive ciò che viene detto, con timestamp. Scarica la trascrizione come testo o come sottotitoli SRT per i tuoi video. Nulla viene caricato.
- 1Trascina un file audio o video (MP3, WAV, M4A, MP4).
- 2Fai clic su Trascrivi e lascia che l’AI ascolti (un minuto o due).
- 3Copia il testo o scaricalo come .txt / sottotitoli .srt.
Casi d’uso
Cosa fa Audio to Text
- ✓Trascrizione accurata con timestamp di frase, pronta per i sottotitoli.
- ✓Download .txt e .srt in un clic, più copia negli appunti.
- ✓Lingua rilevata automaticamente tra 99 lingue, inclusi italiano e inglese.
- ✓Il modello si scarica una volta (~40MB) e resta in cache: poi la trascrizione funziona anche offline.
- ✓Privato per costruzione: le registrazioni non lasciano mai il dispositivo.
Specifiche
- Speed
- Circa in tempo reale su clip brevi, sul dispositivo
- Input
- MP3, WAV, M4A, MP4
- Output
- Testo semplice, .txt, .srt con timestamp
- Privacy
- AI sul dispositivo, zero caricamenti
- Cost
- Gratis, illimitato, senza registrazione
Domande frequenti
Il mio audio viene caricato da qualche parte?
No. Il modello vocale Whisper gira completamente nel tuo browser. La registrazione non lascia mai il tuo dispositivo.
Quali lingue sono supportate?
Decine, tra cui italiano, inglese, spagnolo, francese e tedesco: il modello rileva automaticamente la lingua.
Cosa ottengo alla fine?
Testo trascritto semplice più segmenti con timestamp, scaricabili come file .txt o sottotitoli .srt.
Perché la prima esecuzione richiede tempo?
Il modello AI (~40MB) si scarica una volta e resta in cache. La trascrizione gira poi in locale e dura circa quanto i clip brevi.