语音转文字

免费将语音转换为文字,可无限次使用。选择音频文件或使用麦克风录音,即可在本机生成转录文字和字幕。

将音频文件拖到此处,或点击选择

音频在此浏览器中处理,不会上传到服务器。

标准模式更快,内存占用更少。增强模式可能改善识别效果,但下载量更大,需要更多内存和处理时间。

默认自动检测语言。如果检测不准确,请手动选择语言。

说话人编号为估算结果,请核对。

使用此音频转文字工具转录语音笔记、访谈、课程和会议录音。首次运行会下载所需模型;浏览器缓存可用时,后续可重复使用。处理速度取决于设备性能。分享结果前,请检查文字、时间信息和说话人标注。

语音转文字常见问题

音频会被上传吗?

不会。音频解码和语音识别均在浏览器中完成,录音不会上传到服务器。模型及处理资源未缓存时,需要联网下载。

应当选择哪种语言?

自动检测会根据录音开头附近的语音识别语言,也可以手动选择。支持多种语言,但识别效果会受到语言、口音、噪声和录音质量的影响。混合语言及多人同时说话的内容需要仔细核对。

标准和增强模式有什么区别,应该怎么选?

默认选择增强模式。它可能改善识别效果,但首次下载量更大、内存占用更多,通常也需要更长的处理时间。更看重识别效果时,可以选择增强模式。标准模式更快、内存占用更少,适合长录音或资源有限的设备。

可以标注不同说话人吗?

说话人标注为可选功能,默认关闭。它会估算发言者,可能出错,短发言或重叠语音尤其容易出错。

相关工具: AI 音频降噪 · 音频拆分工具 · 字幕编辑器 · SRT 时间轴调整工具 · VTT 时间轴调整工具