LogoClawIndex
案例技能关于
LogoClawIndex

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。

使用该输入的 Skills:audio files

浏览使用该输入的技能列表。

  • ai-voice-cloning - 通过 Inference.sh CLI 生成 AI 语音
    AI 语音TTS语音生成文本转语音

    ★ 748 · 更新于 2026-06-15

    通过 inference.sh CLI 生成自然 AI 语音

    ⚙ 生成语音⚙ 创建配音⚙ 转换语音
  • stacks-ai - Stacks AI 集成
    AI 集成LLM图像生成RAG

    ★ 2 · 更新于 2026-05-28

    集成多提供商 AI 驱动、图像生成、视觉分析、RAG 和个性化功能到 Stacks 应用

    ⚙ 生成聊天响应⚙ 流式传输聊天消息⚙ 生成文本提示
  • audiowaveform - 从音频文件生成波形可视化图
    audiowaveform波形音频可视化

    ★ 0 · 更新于 2026-05-09

    使用BBC的audiowaveform工具从音频文件生成波形可视化图

    ⚙ 生成波形图像⚙ 导出JSON峰值数据⚙ 导出二进制峰值数据
  • dialogue-audio - 创建多说话人对话音频
    文本转语音多说话人对话音频生成

    ★ 748 · 更新于 2026-05-09

    使用Dia TTS创建多说话人对话音频

    ⚙ 创建多说话人对话⚙ 生成带说话人标记的音频⚙ 控制情感表达
  • audiowaveform - 音频波形可视化生成器
    音频波形可视化播客

    ★ 155 · 更新于 2026-05-09

    从音频文件生成波形图像和峰值数据,用于网页播放器和可视化

    ⚙ 生成波形图像⚙ 创建PNG波形⚙ 渲染SVG波形
  • dws - 管理钉钉产品能力
    钉钉企业办公办公套件团队协作

    ★ 12 · 更新于 2026-03-26

    管理钉钉产品能力,包括AI表格、日历、通讯录、文档、群聊、待办、邮箱、听记、日志、钉盘和OA审批

    ⚙ 管理AI表格记录⚙ 查询日历日程⚙ 搜索通讯录用户
  • ai-podcast-creation - 创建AI播客和音频内容
    播客文本转语音音频生成AI音乐

    ★ 57 · 更新于 2026-03-25

    使用文本转语音、音乐和音频编辑创建AI驱动的播客

    ⚙ 生成播客片段⚙ 从文本生成语音⚙ 创建背景音乐
  • ai-podcast-creation - 创建AI驱动的播客和音频内容
    AI播客文本转语音音频生成播客制作

    ★ 0 · 更新于 2026-03-25

    使用文本转语音、音乐生成和音频编辑工具生成播客和音频内容

    ⚙ 生成音频片段⚙ 转换文本为语音⚙ 创建背景音乐
  • audio-speaker-tools - 说话人分离与音频处理工具
    音频处理说话人分离语音克隆说话人验证

    ★ 0 · 更新于 2026-03-24

    使用Demucs、pyannote和Resemblyzer分离说话人、比较语音和处理音频文件

    ⚙ 分离音频中的说话人⚙ 比较语音样本⚙ 提取音频片段
  • audio-speaker-tools - 说话人分离与语音比较工具
    音频说话人语音分离

    ★ 816 · 更新于 2026-03-24

    从音频中分离说话人并测量文件间的语音相似度

    ⚙ 从音频中分离说话人⚙ 提取音频片段⚙ 比较语音样本
  • unix-media-compressor - 在 macOS 和 Linux 上压缩媒体文件
    媒体压缩文件优化图像压缩视频压缩

    ★ 1 · 更新于 2026-03-24

    在 macOS 和 Linux 上压缩和优化图像、视频、音频、PDF 和存档文件

    ⚙ 压缩 JPEG 图像⚙ 压缩 PNG 图形⚙ 转换为 WebP
  • deepgram-common-errors - Deepgram错误诊断与修复
    SaaSDeepgramAPI调试

    ★ 63 · 更新于 2026-03-24

    诊断并修复Deepgram API错误、WebSocket问题和转录失败

    ⚙ 测试API密钥⚙ 检查HTTP状态码⚙ 分析音频格式
  • audio-handler - 音频处理器
    音频文件转换音量

    ★ 816 · 更新于 2026-03-19

    处理多种格式的音频文件

    ⚙ 提取元数据⚙ 读取音频文件⚙ 转换格式
  • speech-to-text - 使用Whisper模型进行音频转录
    音频转录whisper语音

    ★ 211 · 更新于 2026-02-23

    通过inference.sh CLI使用Whisper模型将音频转录为文本

    ⚙ 音频转录⚙ 音频翻译⚙ 生成时间戳
  • unsloth-tts - 使用Unsloth微调TTS模型实现语音克隆
    TTS语音克隆音频微调语音合成

    ★ 0 · 更新于 2026-02-15

    优化文本转语音模型的微调,实现语音克隆和合成语音生成

    ⚙ 加载TTS模型⚙ 准备音频数据⚙ 标注文本转录
  • voice-agent - 本地语音输入输出的AI语音代理后端
    语音音频语音识别语音合成

    ★ 4 · 更新于 2026-02-13

    通过语音代理API为智能体提供本地语音输入输出能力。

    ⚙ 转录音频文件⚙ 合成文本为音频⚙ 检查API健康状态
  • voice-agent - 本地语音交互AI语音代理后端
    语音音频语音合成本地

    ★ 0 · 更新于 2026-02-13

    使用AI语音代理API为智能体提供本地语音输入/输出功能

    ⚙ 转录音频文件⚙ 合成文本为音频⚙ 检查API健康状态
  • whisper-transcribe-docker - 使用 Docker 进行本地语音转文字转录
    语音转文字转录docker本地处理

    ★ 54 · 更新于 2026-02-13

    在 Docker 容器中使用 faster-whisper 本地转录音频文件为文本

    ⚙ 转录音频文件⚙ 生成带时间戳的转录稿⚙ 输出文本或 JSON 格式
  • openai-whisper-api - OpenAI Whisper API 音频转录
    音频转录语音转文字openai

    ★ 1 · 更新于 2026-02-12

    使用 OpenAI 的 Whisper API 转录音频文件

    ⚙ 转录音频文件⚙ 输出文本转录⚙ 输出JSON转录
  • ffmpeg - FFmpeg多媒体处理框架,用于视频/音频编码和流媒体处理
    多媒体视频处理音频处理流媒体

    ★ 1 · 更新于 2026-02-11

    处理多媒体文件,用于格式转换、编码、流媒体传输、滤镜处理和格式优化

    ⚙ 转换媒体格式⚙ 编码视频编解码器⚙ 处理音频文件

Scroll to load more