语音转文字

上传录音,AI 自动转成文字——转写内容实时流式生成,全程本地。

语音转文字能做什么

一小时的会议录音,人工整理要三小时;语音转文字把它压缩到几分钟:上传录音,转写内容像字幕一样实时流式生成,完成后导出 TXT 直接归档。访谈整理、课程录音存档、语音备忘录变文字稿,都是它的主场。

转写引擎是 OpenAI Whisper 的开源版本,提供四档选择:Tiny 速度最快,Base 精度与速度更均衡,两者都有多语言版本——中文语音选多语言档即可。

使用步骤

1. 选择音频文件(mp3、wav、m4a、ogg,约 200 MB 以内)。
2. 选择模型与语言,首次使用会先下载模型。
3. 点击「开始转写」,内容实时生成,完成后可导出 TXT。

常见问题

首次转写为什么等得久?

需要先下载模型(数百 MB,按所选模型而异),之后浏览器缓存,再转写即秒级启动。

选哪个模型?

英语内容选 Tiny 或 Base;中文等非英语内容选多语言版;追求更准且时间充裕选 Base。

录音会上传吗?

不会。转写在你的浏览器内运行——会议与访谈的隐私,从这里开始。

隐私说明

语音是最私密的媒介之一,本工具把 Whisper 模型搬进你的浏览器:录音不经过网络、不被存储。涉及商业机密或个人隐私的录音,也请放心转写。