💬Audio to Text
语音转文字,附带 SRT 字幕. 免费、私密、无需注册 — 文件永不离开你的浏览器。
First run downloads the AI speech model once (~40MB), then it’s fast. 100% private — on-device.
说出的话,变成带时间戳的文字。
端侧人工智能听写音频与视频,逐词成稿并附时间,可一键生成字幕,文件从不上传。
99
种语言
自动识别,含中文
SRT+TXT
导出格式
带时间戳的字幕输出
0
上传
端侧人工智能
免费
永久免费
无需注册
Audio to Text使用方法
把说出的话变成文字。拖入音频或视频文件,端侧人工智能逐句写出内容并打上时间戳,可下载纯文本或 SRT 字幕。所有处理都在本地,文件从不上传。
- 1拖入音频或视频文件(MP3、WAV、M4A、MP4)。
- 2点击转写,让人工智能听写一两分钟。
- 3复制文本,或下载 TXT 与 SRT 字幕文件。
使用场景
视频字幕
下载 SRT 文件,给短视频、短剧与长视频配上精准字幕。
会议与课堂笔记
把录音变成可搜索的文字,方便浏览、引用与分享。
访谈整理
记者与研究者无需按分钟付费,即可获得带时间戳的记录。
Audio to Text能做什么
- ✓逐词精准转写并按句打时间戳,可直接用于字幕。
- ✓一键下载 TXT 与 SRT,支持复制到剪贴板。
- ✓自动识别 99 种语言,包括中文与英语。
- ✓模型下载一次(约 40MB)即被缓存,之后可完全离线转写。
- ✓天生私密:录音从不离开设备。
规格
- Speed
- 短片段接近实时转写,全程端侧
- Input
- MP3、WAV、M4A、MP4
- Output
- 纯文本、TXT、带时间戳 SRT
- Privacy
- 端侧人工智能,零上传
- Cost
- 免费、无限量、无需注册
常见问题
我的音频会被上传到别处吗?
不会。语音模型完全在浏览器中运行,录音从不离开你的设备。
支持哪些语言?
支持数十种语言,包括中文、英语、西班牙语、法语与德语,模型会自动识别语种。
最后能得到什么?
纯文本转写加带时间戳的分段,可下载 TXT 或 SRT 字幕文件。
为什么第一次运行比较久?
人工智能模型(约 40MB)只需下载一次并缓存,转写本身在本地运行,短片段耗时与音频时长接近。