★ 0 · 更新于 2026-09-21
提供 NVIDIA Nemotron Speech (Riva) 的 ASR、TTS 与 NMT 任务路由,支持云端与本地部署及测试。
浏览带有该标签的技能列表。
★ 0 · 更新于 2026-09-21
提供 NVIDIA Nemotron Speech (Riva) 的 ASR、TTS 与 NMT 任务路由,支持云端与本地部署及测试。
★ 96 · 更新于 2026-09-14
将 YouTube 链接或本地视频转换为带有中文字幕、中文配音和音频混音的中文本地化视频成片。
★ 4 · 更新于 2026-09-13
提供基于 Azure AI Transcription 的 Python 客户端库,用于实时与批量语音转文本、时间戳记录及说话人识别。
★ 288 · 更新于 2026-09-12
将音频文件转写为文本,并支持可选的说话人日志和已知说话人提示。
★ 0 · 更新于 2026-09-09
使用本地 faster-whisper 对输入的音频剪辑进行转录,生成逐字稿、要点摘要及待办事项。
★ 0 · 更新于 2026-09-09
使用 OpenAI 音频转录 API 将音频文件转录为文本或 JSON。
★ 0 · 更新于 2026-09-09
通过 OpenAI 音频转录 API 接口转录音频文件。
★ 18 · 更新于 2026-09-09
修复与 GitHub Agentic Workflows 相关的口述内容中的语音转文本识别错误、空格及连字符格式。
★ 16 · 更新于 2026-05-28
使用 OpenAI Realtime、Vapi、Deepgram、ElevenLabs、LiveKit 和 WebRTC 开发实时语音应用
★ 33 · 更新于 2026-03-22
通过 EachLabs API 提供文字转语音、语音转文字、声音转换和音频处理
★ 816 · 更新于 2026-03-21
适用于 Apple Silicon 的高性能音频库,支持语音合成和语音识别
★ 54 · 更新于 2026-02-13
在 Docker 容器中使用 faster-whisper 本地转录音频文件为文本
★ 1 · 更新于 2026-02-12
使用 OpenAI 的 Whisper API 转录音频文件