在线把 MP3 音频转成可编辑、自动加标点的文字。上传音频或直接录音,核对带时间轴的文字稿,再导出 TXT、SRT 或纯文本——免费起步,文件任务完成即清理。
两个小时的会议录音,只有一下午时间要整理成能读的纪要。
电话访谈回来是一堆 MP3,我需要能搜索、能引用的原文,不是摘要。
这期播客既要给网站一份文字版,又要给视频上传一份 SRT。
上传、选语言,剩下交给 AI。无需安装任何软件。
几下点击就够了。
几下点击就够了。
几下点击就够了。
几下点击就够了。
MP3 是音频最常见的落点:通话录音、语音备忘、播客母带、会议记录、访谈磁带。在这里转成文字只要一步:上传文件、选择语言,就能拿到一份自动断句、自动加标点、每行带时间轴的文字稿——这正是「一坨文字」和「能用的稿子」的区别,因为你可以点某一句话回去听那一刻。清晰音源下准确率最高可达 98%;但如果是在会议室远端用笔记本麦克风录的,别指望这个数,大段互相抢话是最常见的翻车场景。长文件会自动分段,数小时的录音不用先裁切。要会议纪要、文章素材就导出 TXT / 纯文本;音频还要配回视频就导出 SRT;面向海外市场还能翻成 67+ 种语言。计费 1 积分 / 分钟音频,注册赠 20 积分。
语音备忘、通话录音、课堂录音、会议音频都是常规输入。音频和视频容器都接受,不需要先自己分离轨道。
文字稿带时间轴,核对一句话或一个数字只要一次点击,不用在几小时音频里来回拖。长文件始终是一条连续时间轴。
要纪要、文章、节目笔记就导出 TXT / 纯文本;音频属于某个视频就导出 SRT;面向海外市场可以翻成 67+ 种语言。
上传 MP3、选择音频语言后开始任务,就能拿到一份带标点和时间轴的可编辑文字稿,可导出 TXT、纯文本或 SRT。计费按 1 积分 / 分钟音频,注册赠 20 积分并有每日免费额度。
清晰音源下最高约 98%——单人说话、背景安静、麦克风正常。电话线路压缩、多人重叠说话、口音重、人声底下有音乐,都会让准确率下降。带时间轴的好处是可以直接跳到需要核对的那几句话,不用通读整份稿子。
能。数小时的文件会自动分段,时间轴保持连续,不需要事先切分。处理过程中可以看进度,完成的任务留在历史里,重新导出不用再扣一次费。
不会——输出是一份连续、带时间轴的文字稿,这已经能满足多数记纪要、引用和做字幕的需求;它不是「谁说了什么」的报表,多人录音时说话人归属仍需要在编辑时自行标注。
WAV、M4A、AAC、FLAC;如果音频还在视频容器里,MP4、MOV、MKV、WebM 等视频文件也可以直接上传。也可以不传文件,直接用麦克风在浏览器里录制。
只用于你发起的这次任务,任务完成即清理;不与第三方共享,也不用于训练。任务失败不扣积分。
我们仅使用本地存储保存您的登录状态与偏好,不使用追踪 Cookie,也不展示第三方广告。 详见 隐私政策
视语 SpeakVid 不使用追踪或广告类 Cookie,实际使用的存储仅以下一项。