音频会被上传吗?
不会。音频解码和语音识别均在浏览器中完成,录音不会上传到服务器。模型及处理资源未缓存时,需要联网下载。
免费将语音转换为文字,可无限次使用。选择音频文件或使用麦克风录音,即可在本机生成转录文字和字幕。
将音频文件拖到此处,或点击选择
音频在此浏览器中处理,不会上传到服务器。
标准模式更快,内存占用更少。增强模式可能改善识别效果,但下载量更大,需要更多内存和处理时间。
默认自动检测语言。如果检测不准确,请手动选择语言。
说话人编号为估算结果,请核对。
使用前请检查文字、时间戳及说话人标注。
使用此音频转文字工具转录语音笔记、访谈、课程和会议录音。首次运行会下载所需模型;浏览器缓存可用时,后续可重复使用。处理速度取决于设备性能。分享结果前,请检查文字、时间信息和说话人标注。
不会。音频解码和语音识别均在浏览器中完成,录音不会上传到服务器。模型及处理资源未缓存时,需要联网下载。
自动检测会根据录音开头附近的语音识别语言,也可以手动选择。支持多种语言,但识别效果会受到语言、口音、噪声和录音质量的影响。混合语言及多人同时说话的内容需要仔细核对。
默认选择增强模式。它可能改善识别效果,但首次下载量更大、内存占用更多,通常也需要更长的处理时间。更看重识别效果时,可以选择增强模式。标准模式更快、内存占用更少,适合长录音或资源有限的设备。
说话人标注为可选功能,默认关闭。它会估算发言者,可能出错,短发言或重叠语音尤其容易出错。
相关工具: 文字转语音 · AI 音频降噪 · 音频拆分工具 · 字幕生成器 · 字幕编辑器 · SRT 时间轴调整工具 · VTT 时间轴调整工具
格式化、美化 Java、Python、JavaScript、JSON、HTML 等代码,统一缩进、空格和换行。
查看、比较和校验 JSON,测试 JSONPath,或将数据转换为 CSV、YAML、XML。
打开并编辑 CSV 或 Excel 表格、整理表格文本,并将 CSV 转为 Excel 或 SQL。
编写和预览 Markdown、渲染 Mermaid 流程图,并转换 Markdown、HTML 与表格。
对比文本、统计字数和词频、排序或替换文本行,还可查看 DOCX 文本。
在 MP3、WAV、FLAC 等格式间转换,播放普通或原始 PCM 音频,并查看或编辑元数据。
裁剪、合并或拆分录音,去除静音与噪声,调整音量、速度、音调或声道。
将音频转录为文字、将文字生成语音,或直接在浏览器中录音。
转换和压缩视频、裁剪或合并片段、调整画面尺寸、提取音频。
播放本地或在线视频、录制屏幕或摄像头,也可把摄像头用作在线镜子。
压缩或合并 PDF、拆分与重排页面、将页面转成图片,并查看或比较文档。
转换图片格式、调整或裁剪照片、压缩文件、比较图片,并用 OCR 提取文字。
截图并美化画面,将文字做成图片或 GIF,在白板上绘制,还可生成词云和网站图标。
结合视频预览编辑 SRT、VTT 字幕,校准时间、转换格式并管理视频字幕轨。
打开 ZIP、7Z、RAR 或 TAR,选取文件解压;也可创建压缩包,并为 ZIP、7Z 设置密码。
编码或解码 Base64、Base32,转义 URL、HTML 和 Unicode 文本,并查看 JWT 内容。
在二进制、十进制和十六进制之间换算,将数字写成英文,或把文本转为二进制。
计算百分比和分数,汇总统计数据,还可计算成绩、折扣和宽高比。
显示在线时钟、运行倒计时或秒表,并计算日期、年龄与时区差异。
查看 IP 与 IPv6 连接、检查 HTTP 请求或 HAR 文件,并计算 CIDR 地址范围。
换算长度、重量、温度、数据存储等单位。
转换 HEX、RGB、HSL 色值,从图片提取颜色、检查对比度,或用纯色画面测试显示器。
生成和识别二维码、条形码,包括网址和 Wi-Fi 网络的二维码。
生成哈希值、UUID 和密码,测试正则表达式、创建 URL 别名,并检查文件权限。
查看屏幕分辨率与刷新率、用屏幕尺测量、测试按键,或使用提词器。
2048、扫雷、数独、五子棋、坦克大战