ビデオを文字起こしする

● 100%ブラウザに記録されているので、録画はこのデバイスから出ません

Loading…

動画のスピーチをプレーンテキストに書き起こしてください。音声トラックはデコードされ、自分のマシンでWhisperで処理されるため、録音は録音から離れず、書き起こしは終わった後に.txtダウンロードされます。

使い方

  1. 音声ファイルや動画をドロップすると、その音声トラックがデバイス上でデコードされます。
  2. モデルを選んでください:Fast(≈41MB、一度ダウンロード)かAcactible(≈77MB)。
  3. 文字起こし、テキストのライブ配信を見学、.txt、.srt、または.vttをダウンロードしてください。

よくある質問

私のファイルはアップロードされますか?
いいえ。モデルやすべての処理は、自分のデバイス上のブラウザ内で動作します。ご自身で確認できます:ブラウザの DevToolsを開き、ネットワークタブを見てファイルを処理すると、アップロードはありません。初回訪問後はほとんどのツールも完全にオフラインで動作します。
その精度はどのくらいですか?
モデルはOpenAIのWhisper(小型および基本ティア)です。クリアな発話時は非常に使いやすいです。強いアクセント、クロストーク、騒がしい部屋ではエラーが見られます。Acactateティアは難しい音質では明らかに優れています。
どの言語が使えますか?
モデルは多言語対応で、現在は英語で文字起こしが行われています。さらに多くの言語が計画されており、モデル自体はすでに99言語をサポートしています。
どのくらい時間がかかりますか?
対応 GPUのあるマシンでは、1分あたり数秒の音声です。CPU専用のマシンでは遅いですが実用的で、録音の長さの約4分の1です。

関連ツール