语音转文字:免费把音频转成文字
用 AI 把语音转成文字。上传音频或视频,或用麦克风录音,即可获得 25 种以上语言的准确转写。免费,无需注册。
免费 AI 处理,不保存任何内容 无需注册
正在加载语音转文字…
由我们的 AI 引擎安全处理。你的内容只使用一次,绝不保存。
如何使用语音转文字
- 1
在此页面打开语音转文字,它直接在浏览器中加载。
- 2
添加文件、文本或数值,并调整设置。
- 3
由我们的 AI 引擎安全处理。你的内容只使用一次,绝不保存。
关于此工具
这款免费的 语音转文字 工具使用 Whisper 把口语转换为书面文字。Whisper 是基于数十万小时音频训练的 AI 语音识别模型。上传语音消息、采访、讲座、播客或视频,或直接用麦克风录音,即可得到可编辑、复制或下载的转写文本。它对口音、快速语速和背景噪音的处理远胜旧式听写工具。
如何把音频转成文字
- 把音频或视频文件拖到页面上,或点击 Record with microphone 开始说话。
- 语言保持自动识别,或在片段较短、噪音较大时手动选择。
- 选择 Fast 快速出草稿,或选择 Best accuracy 处理重要录音。
- 点击 Transcribe,然后编辑文本,复制或下载为 .txt 文件。
可以转写哪些内容
- 来自微信、WhatsApp、Telegram 或手机录音机的 语音消息和备忘录(M4A、OGG、OPUS)。
- 在 Zoom、Teams 或录音笔上录制的 采访和会议。
- 用于学习笔记、节目简介或引用的 讲座和播客。
- 视频(MP4、MOV、WebM):自动提取语音,便于制作字幕和撰写文章。
快速还是最高准确度?
| 模式 | 适用场景 | 速度 |
|---|---|---|
| Fast | 清晰语音、语音消息、草稿 | 通常远短于音频时长 |
| Best accuracy | 采访、口音、嘈杂环境、人名和术语 | 较慢,约等于或短于音频时长 |
获得准确转写的技巧
- 靠近说话人录音,远离风扇、车流和音乐。
- 片段较短或混合多种语言时,请手动选择语言。
- 拆分超长录音:每个文件最长 25 分钟。较长的文件可用 MP4 转 MP3 转换器 裁剪。
- 核对人名和数字:AI 转写效果很好,但并非完美。
您的隐私
发送前,浏览器会先提取音频并压缩为小型单声道文件,因此即使是大视频也能快速上传。音频通过加密连接发送到我们的语音引擎,转写后即被删除。我们不保存录音或转写内容,也绝不会用它们训练模型。
想反过来让文字朗读出来?使用 文字转语音。只需要视频里的声音?试试 MP4 转 MP3 转换器。
功能
- 基于 Whisper AI 转写,口音和背景噪音下依然准确
- 支持上传 MP3、M4A、WAV、MP4、MOV 等,或用麦克风录音
- 自动识别语言,可选 25 种以上语言
- 快速模式或最高准确度模式
- 可编辑、复制转写文本或下载为 .txt
- 音频先在设备上压缩,转写完成后即删除
常见问题
如何免费把语音转成文字?
上传音频或视频文件,或用麦克风录音,然后点击 Transcribe。几秒钟后即可得到文本,可编辑、复制或下载,无需注册。
支持哪些语言?
超过 25 种,包括英语、西班牙语、法语、德语、葡萄牙语、印地语、乌尔都语、阿拉伯语、中文、日语和俄语。自动识别会替你选择语言。
可以把视频转成文字吗?
可以。上传 MP4、MOV 或 WebM 视频,语音会被自动提取并转写。
音频最长可以多长?
每个文件最长 25 分钟。较长的录音请拆分或裁剪后分段转写。
我的音频会被保存吗?
不会。音频被安全发送到我们的语音引擎,转写后立即删除。我们不保留录音或转写内容。
转写准确吗?
它使用 Whisper,这是最准确的语音识别模型之一,能很好地处理口音和噪音。重要录音请选择 Best accuracy,并核对人名和数字。
