转录德语音频

● 100%在浏览器里,这样录制就不会离开这个设备

Loading…

在浏览器中完全运行Whisper,将语音转为文本和字幕。录音永远不会离开你的机器,这对人们需要转录的录音最为重要:采访、会议、口述、法律和医疗音频。

使用方法

  1. 放一个音频文件或视频,音频轨道就会在你的设备上解码。
  2. 选择一个型号:快速(≈41 MB,下载一次)或 Accurate (≈77 MB)。
  3. 转录,观看文本实时呈现,并下载.txt、.srt或.vtt。

常见问题

我的文件会上传吗?
不。模型和所有处理都运行在你自己的设备上的浏览器中。你可以自己验证:打开浏览器 DevTools,关注网络标签,处理文件:没有上传。第一次访问后,大多数工具也能完全离线使用。
它有多准确?
这些模型是OpenAI的Whisper(有小层和基础层)。在清晰的语音下,它们非常实用;重音、串联和嘈杂的房间会显示错误。准确档在难度音频上明显更好。
哪些语言有效?
模型支持多语言,目前转录为英语。计划推出更多语言:模型本身已支持99种。
需要多长时间?
在支持 GPU的机器上,音频速度为每分钟几秒。在仅支持CPU的机器上,虽然速度较慢,但仍实用,约为录音长度的四分之一。

相关工具