由 OpenAI Whisper 驱动MP3 转文字工具

把 MP3 音频 转成可编辑文字

让播客、访谈、课程和语音笔记更容易搜索、引用和再次使用。

登录后每天可免费转录 3 次,无需信用卡。

查看无限版价格

Whisper

多语言语音识别

自动

识别口语语言

SRT + VTT

带时间戳字幕

MP3 转录

从音频到可用文字

清晰语音和质量较好的原始录音,通常会带来更好的转录初稿。

  1. 01

    选择 MP3

    尽量使用最清晰的录音。

  2. 02

    设置语言

    使用自动识别,或从 100 种语言中选择。

  3. 03

    检查并导出

    检查人名和专业词汇,再选择导出格式。

由 OpenAI Whisper 提供支持

识别 100 种口语语言

自动检测口语语言,将常见音频和视频中的语音转换成带时间信息的文字。

适合语音内容

让长 MP3 录音更容易使用

不用反复播放整段录音,也能快速浏览其中的想法。

01

播客

为节目笔记、引用和文章准备可搜索文字。

节目到文字

02

访谈

快速找到回答,并查看前后文。

录音到研究笔记

03

课程和语音笔记

把口述想法变成可以整理和复习的文字。

语音到参考资料

多种导出格式

下载文字,也能直接导出字幕

可导出 Word、PDF、纯文本、字幕、表格、网页文件和结构化数据。免费版导出会带有简短的 ScribeZip 标记;无限版不会添加。

TXT

适合笔记和文档的纯文本

DOCX

可继续编辑的 Microsoft Word 文档

PDF

适合分享和打印的转录稿

SRT

带序号和时间戳的字幕

VTT

适合网页视频的时间字幕

CSV

适合表格处理的时间片段

MD

适合写作和发布的 Markdown

HTML

可直接打开的网页文档

JSON

结构化文字和片段数据

01登录账号
02私密上传
03AI 语音转录
04账号内结果

默认保护隐私

媒体文件只在你的账号内处理

上传必须在登录后的工作台中进行,文件不会被发布成公开媒体页面。

  • 登录后才会真正开始上传文件
  • 处理期间使用私密文件存储
  • 源媒体默认在处理结束后删除
  • 只有你的账号可以查看转录历史

MP3 转文字常见问题

怎样把 MP3 转成文字?

进入工作台,选择 MP3,设置语言或自动识别,然后开始转录。

MP3 音质会影响结果吗?

会。语音越清楚、背景噪音越少通常越有帮助,重要信息仍需检查。

Whisper 可以识别 MP3 中的多个说话人吗?

Whisper 会转录语音,但不会添加说话人标签。如需该功能,需要另外接入说话人分离模型。

MP3 可以生成字幕吗?

可以,可以把带时间戳的片段下载成 SRT 或 VTT。

不用再反复播放同一分钟

把 MP3 变成可以浏览的文字。