什么是说话人分离?
说话人分离会自动识别音频文件中的多位说话人,并分辨出每个人说了什么。你拿到的不是一整块文字,而是每段话都标注了说话人的转录文本,对话脉络清晰,谁说了什么一看便知。系统全自动运行,不需要你事先登记说话人或提供声音样本。
- 自动识别录音中的不同说话人
- 为每段话标注说话人(说话人 A、B、C 等)
- 说话人数量不限
- 无需事先登记或提供声音样本
- 非常适合会议、采访和多人对话
工作原理
开启说话人分离后,LiteScribe 会分析音频模式、声音特征和说话方式,以区分不同的说话人。系统会自动切分音频,并把每一段分配给对应的说话人。
- 上传你的音频或视频文件
- 在转录设置中开启说话人分离
- AI 分析声音模式和说话特征
- 每段话自动标注说话人
- 按需检查和编辑说话人标签
自定义说话人名称
在 Pro 和 Business 套餐中,你可以为说话人设置自定义名称,把“说话人 A”这样的通用标签换成真实姓名。转录文本会更易读,也更方便与团队分享。
- 把“说话人 A”换成真实姓名(例如“张伟”“李娜”)
- 转录完成后随时编辑说话人标签
- 说话人时间轴直观显示谁在什么时候发言
- 导出的转录文本包含自定义说话人名称
- 非常适合参会者固定的例会
应用场景
凡是多人参与的录音都离不开说话人分离,它让对话脉络清晰,谁说了什么一目了然。
- 会议纪要:看清每个观点是哪位同事提出的
- 采访文字稿:区分采访者和受访者
- 播客转录:识别主持人和嘉宾
- 电话会议:记录每位参会者的发言
- 法律取证:清楚标明每段陈述的出处
FAQ
常见问题
说话人分离的准确度取决于音质、说话人数量以及声音的区分度。在音质清晰的优质录音中,系统通常能达到很高的准确度。转录完成后,你随时可以检查并修正说话人标签。
不需要。说话人分离全自动运行,无需事先登记或提供声音样本。系统会根据声音模式和特征,自动识别并标记不同的说话人。
能。在 Pro 和 Business 套餐中,你可以为说话人设置自定义名称,并在转录完成后随时编辑标签。把“说话人 A”这样的通用标签换成真实姓名,读起来更清楚。
说话人分离可以识别任意数量的说话人,不过在人数很多(10 人以上)或声音非常相似时,准确度可能下降。为获得最佳效果,请确保音质良好、背景噪音尽量少。
支持。说话人分离适用于 LiteScribe 转录支持的所有语言。系统分析的是声音模式和特征,而不是语言内容,因此在不同语言中都能使用。