★ 0 · 更新于 2026-09-21
提供 NVIDIA Nemotron Speech (Riva) 的 ASR、TTS 与 NMT 任务路由,支持云端与本地部署及测试。
浏览带有该标签的技能列表。
★ 0 · 更新于 2026-09-21
提供 NVIDIA Nemotron Speech (Riva) 的 ASR、TTS 与 NMT 任务路由,支持云端与本地部署及测试。
★ 1 · 更新于 2026-09-20
通过 inference.sh CLI 调用模型创作用于广告、促销、新品发布和品牌推广的 AI 营销视频。
★ 0 · 更新于 2026-09-19
使用 inference.sh CLI 构建结合图像、视频、音频和文本的多步骤 AI 内容创作流水线。
★ 748 · 更新于 2026-09-17
通过 inference.sh CLI 使用 Inworld、ElevenLabs、Kokoro 等模型将文本转换为语音。
★ 2 · 更新于 2026-09-15
将学术论文 PDF 转换为包含双人对谈讲稿、双角色语音配音、同步字幕、HTML 播放器及 MP4 的讲解视频。
★ 2 · 更新于 2026-09-13
使用 sherpa-onnx 离线命令行工具在本地将文本转换为语音,无需依赖云端服务。
★ 3 · 更新于 2026-09-12
使用 Telnyx Ruby SDK 播放音频文件、转换文本为语音并记录通话。
★ 18 · 更新于 2026-09-10
使用 Microsoft Edge TTS 引擎将文本转换为中文语音,支持设置声音、语速、音调及导出音频文件。
★ 16 · 更新于 2026-05-28
使用 OpenAI Realtime、Vapi、Deepgram、ElevenLabs、LiveKit 和 WebRTC 开发实时语音应用
★ 0 · 更新于 2026-05-09
构建、维护和扩展 EarLLM One Android 项目,通过语音管道将蓝牙耳机连接到 LLM
★ 748 · 更新于 2026-05-09
使用Dia TTS创建多说话人对话音频
★ 60 · 更新于 2026-03-26
使用TTS系统为功能添加语音辅助,支持语音播放和音频反馈
★ 1 · 更新于 2026-03-26
通过语音链系统将 TTS 音频集成到应用功能
★ 18 · 更新于 2026-03-26
为应用功能添加文本转语音音频辅助
★ 60 · 更新于 2026-03-25
使用文本转语音、音乐和音频编辑创建AI驱动的播客
★ 816 · 更新于 2026-03-24
通过内置CLI或OpenAI音频API将文本转换为语音,适用于旁白、配音、IVR提示或无障碍朗读。
★ 33 · 更新于 2026-03-23
使用 MiniMax 语音 2.6 Turbo 将文字转换为语音,支持语音克隆和多语言
★ 33 · 更新于 2026-03-22
通过 EachLabs API 提供文字转语音、语音转文字、声音转换和音频处理
★ 7 · 更新于 2026-03-22
Claude在用户打字时进行语音朗读的单向TTS模式
★ 10 · 更新于 2026-03-21
基于 AI 的文本转语音和音乐生成
Scroll to load more