ホーム
オーディオ6
動画9
画像2
すべてのツール
アセット
ボイスライブラリ
開発者ドキュメント
ブログ
日本語
料金
ログイン
アプリをダウンロード
オーディオ音声をテキストに変換
AI ポッドキャストテキスト読み上げ音声をテキストに変換ボイスクローンAI ボイスマルチスピーカー音声

音声からテキストへ · 録音と動画の文字起こし

音声をテキストに変換

録音を、そのまま文字起こしに

音声か動画をアップロードすれば、言語は自動で判定します。終わったらコピー、TXT のダウンロード、字幕なら SRT の書き出し。1ファイル最長2時間・50 MB まで。

  • 言語を自動判定
  • 音声・動画17形式に対応
  • 固有名詞や専門用語は参考語彙で補強
  • TXT と SRT 字幕を書き出し

文字起こしはまだありません

最近の音声文字起こしプロジェクトがここに表示されます。

音声をテキストにする方法

  1. 1

    録音を1件アップロード

    AAC、AMR、AVI、FLAC、FLV、M4A、MKV、MOV、MP3、MP4、MPEG、OGG、OPUS、WAV、WEBM、WMA、WMV に対応し、1ファイルにつき最長2時間・50 MB まで。形式、容量、長さはアップロードを始める前に確認します。

  2. 2

    参考語彙を追加する

    任意ですが、人名、ブランド名、略語、社内用語など一般的なモデルが知らない言葉には数秒かける価値があります。最大50件まで登録でき、この端末に保存されて次回もそのまま使えます。

  3. 3

    コピー・保存・字幕化

    処理はサーバー側で進むため、タブを閉じても後から結果を確認できます。完了画面では全文の上に長さと文字数が表示され、コピー、UTF-8 TXT の保存、SRT 字幕の書き出しがそのまま行えます。

音声文字起こしの活用例

インタビューの整理

録音を引用しやすい文字稿にすれば、うろ覚えの一言も音声を巻き戻さずに検索で見つけられます。

議事録づくり

会議の録音を一続きの文字稿にして、プロジェクト資料に貼り付けたり、欠席した人に共有したりできます。

講義と学習ノート

授業や講演を自分のペースで読み返し、専門用語が続く部分は注釈を付けられるテキストとして残せます。

動画の字幕づくり

文ごとのタイムコードから SRT を書き出し、編集ソフトにそのまま読み込めます。字幕を手打ちする必要はありません。

音声からテキストへの変換 FAQ

文字起こしとは何ですか?

音声認識が録音を最後まで聞き取り、話された内容をテキストとして書き出す処理です。手作業の書き起こしを置き換えるので、1時間の音声も読んで検索できる文書に短時間で変わります。

対応している形式は?

AAC、AMR、AVI、FLAC、FLV、M4A、MKV、MOV、MP3、MP4、MPEG、OGG、OPUS、WAV、WEBM、WMA、WMV の17形式です。動画はそのまま渡せるので、音声トラックを取り出す手間はいりません。

ファイルの長さと容量の上限は?

一度に1ファイル、最長2時間・50 MB までです。どちらの上限もブラウザ側で先に確認するため、超えているファイルはアップロードを待たずにその場で分かります。

言語を選ぶ必要はありますか?

いりません。話されている言語は録音から自動で判定されるので、表示言語と録音の言語が違っていても問題ありません。

テキストのほかに字幕も取得できますか?

できます。文ごとに開始と終了の時間を保持しているため、UTF-8 TXT に加えて SRT 字幕ファイルとしても書き出せます。使えるタイムコードが得られなかった録音では、推測で作らずに SRT の書き出しを無効にします。

クレジットはどう計算されますか?

元の録音の開始した1分ごとに1クレジットなので、90秒のファイルなら2クレジットです。送信ボタンに見積もりが表示され、文字起こしに失敗した場合は消費されません。

精度はどのくらいですか?

録音の状態によります。発話が明瞭で、話者が重ならず、雑音の少ない録音ほど精度は上がります。取り違えが起きやすいのは人名、ブランド名、専門用語で、それを補うための参考語彙欄です。

こちらかもしれません

  • AIポッドキャスト生成

    一人が読み上げるのではなく、二人で話し合う形にしたいときはこちら。

  • テキスト読み上げ(TTS)

    原稿がすでにあり、読み上げるだけでよいときはこちら。