💬Audio to Text
Транскрибирайте реч в текст + SRT субтитри. Безплатно, поверително, без регистрация — файловете никога не напускат браузъра.
First run downloads the AI speech model once (~40MB), then it’s fast. 100% private — on-device.
Изговорени думи в текст, с времеви маркери.
Локалният ИИ слуша вашето аудио или видео и записва всяка дума — с времена, които може да превърнете в субтитри. Нищо не се качва.
Как се ползва: Audio to Text
Превърнете изговорените думи в писмен текст. Пуснете аудио или видеофайл и локалният ИИ записва казаното с времеви маркери. Изтеглете транскрипцията като текст или като SRT субтитри за видеата си. Нищо не се качва.
- 1Пуснете аудио или видеофайл (MP3, WAV, M4A, MP4).
- 2Кликнете Транскрибирай и оставете ИИ да слуша (минута-две).
- 3Копирайте текста или го изтеглете като .txt / .srt субтитри.
Случаи на употреба
Какво умее Audio to Text
- ✓Транскрипция с точност до думата с времеви маркери по изречения, готова за субтитри.
- ✓Изтегляне на .txt и .srt с един клик, плюс копиране в клипборда.
- ✓Езикът се разпознава автоматично сред 99 езика, включително български и английски.
- ✓Моделът се изтегля веднъж (~40MB) и се кешира — транскрипцията работи напълно офлайн след това.
- ✓Поверителен по конструкция: записите ви никога не напускат устройството.
Характеристики
- Speed
- Приблизително в реално време за кратки клипове, на устройството
- Input
- MP3, WAV, M4A, MP4
- Output
- Обикновен текст, .txt, .srt с времеви маркери
- Privacy
- ИИ на устройството, нула качвания
- Cost
- Безплатно, неограничено, без регистрация
Чести въпроси
Качва ли се аудиото ми някъде?
Не. Моделът за разпознаване на реч Whisper работи изцяло във вашия браузър. Записът ви никога не напуска устройството.
Кои езици се поддържат?
Десетки, включително български, английски, испански, френски и немски — моделът разпознава езика автоматично.
Какво получавам накрая?
Обикновен текст на транскрипцията плюс сегменти с времеви маркери, които може да изтеглите като .txt или .srt файлове със субтитри.
Защо първото стартиране отнема време?
ИИ моделът (~40MB) се изтегля веднъж и се кешира. Самата транскрипция работи локално и отнема приблизително дължината на кратките клипове.