说话人分离的含义
说话人分离将语音分成与不同说话人相关的片段。像“说话人 1”这样的标签将系统归因于同一声音的段落分组。仅凭标签无法确定说话人的身份。
ScreenApp 的转录稿可以显示说话人标签。在命名人物或引用他们之前,请使用录音检查这些标签。
查看对话
- 在录音旁边打开转录稿。
- 在清晰的说话人切换处聆听。
- 检查每个段落附加了哪个标签。
- 当您可以确定说话人身份时,重命名标签。
- 检查分配给该标签的其他段落,特别是重叠和简短的插话。
请遵循说话人标签编辑以获取当前控件。重命名标签不会自动纠正每个潜在的归属错误。
处理不确定性
两个声音可能会被分到一组,或者一个人的语音可能会收到多个标签。重叠的语音、轻柔的声音和糟糕的音频会使审查变得更加困难。保持不确定的归属明确,而不是为了让转录稿看起来完整而分配姓名。
如果文字有误,请使用转录稿编辑。如果归属仍然混淆,请保留原始内容并将示例时间戳发送给支持。
改进下一次录音
使用实际的麦克风和参与者进行测试录音。检查所有声音是否清晰可闻,并减少可避免的干扰或交叉对话。说话人自我介绍可以为人工审查提供上下文,但这并不能保证自动识别。
应用的“人物”设置支持识别使用的说话人姓名。只使用您可以从来源和相关人员那里验证的姓名。
检查后导出
更正后下载新的转录稿,以便您的本地副本包含更改。单独阅读摘要和生成的笔记,因为归属错误可能会影响谁对某个行为负责。
准确性和方法包含维护的技术证据和限制。本指南不假设每个录音都使用相同的说话人分离提供商或模型。