LogoClawIndex
案例技能关于
LogoClawIndex

audio-speaker-tools - 说话人分离与语音比较工具

从音频中分离说话人并测量文件间的语音相似度

标签

更新于: 2026-03-24
音频说话人语音分离比较

能力

典型输入

典型输出

该技能可以做什么

  • 从音频中分离说话人
  • 提取音频片段
  • 比较语音样本
  • 测量语音相似度
  • 验证说话人分离结果

输入

  • 音频文件
  • HuggingFace令牌
  • 输出目录

输出

  • 分离的说话人音频文件
  • 语音相似度分数
  • RTTM时间戳文件
  • 片段元数据文件

要求

  • Python 3.9+
  • ffmpeg
  • HuggingFace令牌

来源

  • 规范: SKILL.md

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。
从音频中分离说话人
提取音频片段
比较语音样本
测量语音相似度
音频文件
HuggingFace令牌
输出目录
分离的说话人音频文件
语音相似度分数
RTTM时间戳文件