上传音视频,生成文字与字幕

支持上传音视频,也支持粘贴抖音、B站、小红书链接。自动补充标点、区分说话人并生成时间轴,转写后可边听边读并多格式导出。

选择音频或视频文件

可一次选择多个,也可以分批拖到这里

每批最多 20 个,单个文件最大 2 GB
语义处理
保留口语表达,适合逐字稿减少重复和语气词,适合阅读

中英文模式:可以识别中文、英文、中英混合、粤语、四川话、陕西话、冀鲁话、兰银官话、江淮官话、上海话、闽南语、山西话、客家话,以及东北、北京等常见口音。

导出格式TXT / SRT / VTT / JSON / MD 等格式

最近结果

查看全部

从内容到文字

三步完成一次转写

  1. 01

    提交内容

    批量上传音频、视频,或一次粘贴多条受支持的平台链接。

  2. 02

    等待转写

    系统读取音轨并生成带时间码、说话人信息的文字稿。

  3. 03

    听读并导出

    边听边读转写内容,再按需要选择文字稿、字幕或结构化数据格式。

使用边界

适合整理内容,不替你做最终判断

适合

视频文案整理、字幕初稿、会议录音归档,以及需要继续编辑的音视频文字。

需要留意

口音、噪声和专业术语可能影响结果;重要内容请对照原始音视频校对。

常见问题

开始之前,你可能想确认这些

支持哪些输入方式?

支持批量上传音频、视频文件,也支持一次粘贴多条受支持的平台公开视频链接;每批最多 20 个任务。

可以导出哪些格式?

支持文字稿、字幕、结构化数据和文档格式。同一次识别可重复导出,不重复消耗转写时长。