音声はアップロードされますか?
されません。音声のデコードと文字起こしはブラウザー内で行われ、録音はサーバーにアップロードされません。モデルや処理用リソースがキャッシュにない場合は、ダウンロードにインターネット接続が必要です。
音声を無料で何度でもテキストに変換できます。音声ファイルを選ぶかマイクで録音すると、この端末で文字起こしと字幕を作成できます。
音声ファイルをここにドロップするか、クリックして選択
音声はこのブラウザー内で処理され、サーバーにアップロードされません。
標準モードは処理が速く、メモリ使用量も少なくなります。高性能モードは認識結果を改善する可能性がありますが、ダウンロード容量、必要なメモリ、処理時間が増えます。
既定では言語を自動検出します。検出が正しくない場合は、言語を選んでください。
話者番号は推定のため、確認してください。
使用前に文字、タイムスタンプ、話者ラベルを確認してください。
この音声テキスト変換ツールで、音声メモ、インタビュー、講義、会議の録音を文字起こしできます。初回は必要なモデルをダウンロードし、以降はブラウザーのキャッシュが利用可能な場合に再利用できます。処理速度は端末に依存します。結果を共有する前に、文字、時刻、付与された話者ラベルを確認してください。
されません。音声のデコードと文字起こしはブラウザー内で行われ、録音はサーバーにアップロードされません。モデルや処理用リソースがキャッシュにない場合は、ダウンロードにインターネット接続が必要です。
自動検出では、録音の冒頭付近の音声から言語を判定します。手動で選ぶこともできます。多くの言語に対応していますが、精度は言語、アクセント、雑音、録音品質に左右されます。複数言語や同時発話がある録音は、特に慎重に確認してください。
初期状態では高性能モードが選択されています。認識結果を改善する可能性がありますが、初回のダウンロード容量と必要なメモリが増え、通常は処理時間も長くなります。認識精度を優先する場合は高性能モードを選んでください。標準モードは処理が速く、メモリ使用量も少ないため、長い録音やリソースが限られた端末に適しています。
話者ラベルは任意で、初期状態では無効です。誰が話したかを推定するため、短い発話や重なった声では特に誤る可能性があります。
関連ツール: AI 音声ノイズ除去 · 音声分割 · 字幕エディター · SRT時間調整 · VTT時間調整