B站创作者访谈.mp4

B站创作者访谈.mp4

12:18 · 自动识别语言与说话人 · 今天 11:06

说话人 1

把一段音频整理成文字,最费时间的往往不是听懂,而是反复暂停、定位和重新找到刚才读到的位置。所以这份结果保留了每句话对应的时间点,阅读时可以随时点击时间码,让音频直接跳到这句话开始的位置。同一位说话人的连续表达会合并在一个段落里,避免长音频被切成大量零碎行。

说话人 2

对于几十分钟的访谈、会议或课程,正文需要尽量连续。说话人和时间信息应该清楚,但不应该把内容切成一张张零散的卡片。顶部播放器会在阅读过程中保持可见,拖动进度条可以快速选择时间点。当前播放位置只会突出对应的时间码,不会让整段文字产生选中状态。

说话人 1

左侧保留最近的转写结果,切换文件时不需要先回到首页,也不会丢失正在阅读的上下文。文字稿默认只读,更适合作为资料查看、内容回顾和听读同步的工具。重要内容仍然建议结合原始音频确认,点击段内任意时间码即可从对应句子继续播放。

说话人 2

当文件时长达到一两个小时,页面依然保持同一种阅读结构,时间码、说话人和正文会持续向下排列。每段通常覆盖三十到六十秒,遇到说话人切换时会立即另起一段。用户不需要理解复杂的编辑工具,只需要选择结果、播放音频和阅读文字。