★ 748 · 更新于 2026-06-15
通过 inference.sh CLI 生成自然 AI 语音
浏览使用该输入的技能列表。
★ 748 · 更新于 2026-06-15
通过 inference.sh CLI 生成自然 AI 语音
★ 2 · 更新于 2026-05-28
集成多提供商 AI 驱动、图像生成、视觉分析、RAG 和个性化功能到 Stacks 应用
★ 0 · 更新于 2026-05-09
使用BBC的audiowaveform工具从音频文件生成波形可视化图
★ 748 · 更新于 2026-05-09
使用Dia TTS创建多说话人对话音频
★ 155 · 更新于 2026-05-09
从音频文件生成波形图像和峰值数据,用于网页播放器和可视化
★ 12 · 更新于 2026-03-26
管理钉钉产品能力,包括AI表格、日历、通讯录、文档、群聊、待办、邮箱、听记、日志、钉盘和OA审批
★ 57 · 更新于 2026-03-25
使用文本转语音、音乐和音频编辑创建AI驱动的播客
★ 0 · 更新于 2026-03-25
使用文本转语音、音乐生成和音频编辑工具生成播客和音频内容
★ 0 · 更新于 2026-03-24
使用Demucs、pyannote和Resemblyzer分离说话人、比较语音和处理音频文件
★ 816 · 更新于 2026-03-24
从音频中分离说话人并测量文件间的语音相似度
★ 1 · 更新于 2026-03-24
在 macOS 和 Linux 上压缩和优化图像、视频、音频、PDF 和存档文件
★ 63 · 更新于 2026-03-24
诊断并修复Deepgram API错误、WebSocket问题和转录失败
★ 816 · 更新于 2026-03-19
处理多种格式的音频文件
★ 211 · 更新于 2026-02-23
通过inference.sh CLI使用Whisper模型将音频转录为文本
★ 0 · 更新于 2026-02-15
优化文本转语音模型的微调,实现语音克隆和合成语音生成
★ 4 · 更新于 2026-02-13
通过语音代理API为智能体提供本地语音输入输出能力。
★ 0 · 更新于 2026-02-13
使用AI语音代理API为智能体提供本地语音输入/输出功能
★ 54 · 更新于 2026-02-13
在 Docker 容器中使用 faster-whisper 本地转录音频文件为文本
★ 1 · 更新于 2026-02-12
使用 OpenAI 的 Whisper API 转录音频文件
★ 1 · 更新于 2026-02-11
处理多媒体文件,用于格式转换、编码、流媒体传输、滤镜处理和格式优化
Scroll to load more