AudioVideoClips logoAudioVideoClips

💬Audio to Text

音声を文字起こしして字幕SRTも作成. 無料・プライベート・登録不要 — ファイルはブラウザの外に出ません。

First run downloads the AI speech model once (~40MB), then it’s fast. 100% private — on-device.

話し言葉をタイムスタンプ付き文章に。

端末内AIが音声や動画を聴き取り、一語一句を書き起こします。字幕化できる時刻付きで、アップロードはありません。

99
言語対応
自動判別、日本語含む
SRT・テキスト
出力形式
時刻付き字幕に対応
0
アップロード
端末内AI処理
無料
ずっと
登録不要です

Audio to Textの使い方

話し言葉をそのまま文章にできます。音声や動画ファイルを置けば、端末内AIが内容を書き起こし、タイムスタンプも付けます。テキストや動画用SRT字幕として保存でき、アップロードは一切ありません。

  1. 1音声や動画ファイルをドラッグ&ドロップします(MP3・WAV・M4A・MP4)。
  2. 2「文字起こし」を押してAIに聴かせます(1〜2分程度)。
  3. 3文章をコピーするか、テキスト・SRT字幕として保存します。

活用シーン

動画の字幕作りに
SRTファイルを保存すれば、ショート動画やYouTubeに正確な字幕を付けられます。
会議や講義メモに
録音を検索できる文章にすれば、読み返しや引用、共有が簡単です。
取材の記録に
時刻付き記録が従量課金なしで得られるため、取材や調査に役立ちます。

Audio to Textでできること

仕様

Speed
短い音声ならほぼ実時間、端末内処理
Input
MP3、WAV、M4A、MP4
Output
プレーンテキスト、テキスト、時刻付きSRT
Privacy
端末内AI、アップロードなし
Cost
無料・無制限・登録不要

よくある質問

音声はどこかにアップロードされますか?

いいえ。音声認識モデルはブラウザ内で完全に動作します。録音が端末の外に出ることはありません。

対応言語は何ですか?

日本語・英語・ヒンディー語・スペイン語・フランス語・ドイツ語など数十言語に対応し、言語は自動で判別されます。

最終的に何が得られますか?

プレーンな書き起こし文に加え、タイムスタンプ付き区間をテキストやSRT字幕ファイルとして保存できます。

初回だけ時間がかかるのはなぜですか?

AIモデル(約40MB)を一度取得して保存するためです。文字起こし自体は端末内で行われ、短い音声ならほぼ実時間で処理できます。

その他の無料ツール

もっと細かく編集したい?フル動画+音声エディタを開く →