★ 740 · 更新于 2026-09-28
通过本地 AI 工作流生成和处理语音、字幕、音乐、图片与视频,并支持音频分析和视频剪辑。
浏览使用该输入的技能列表。
★ 740 · 更新于 2026-09-28
通过本地 AI 工作流生成和处理语音、字幕、音乐、图片与视频,并支持音频分析和视频剪辑。
★ 1 · 更新于 2026-09-24
依据 Word 文字与 HTML 问题分段,结合 SRT 字幕与 FunASR 字级时间戳,对 audio_map2 月份 JSON 进行毫秒级对齐与校对。
★ 1 · 更新于 2026-09-18
使用 Whisper 模型对 99 种语言的音频进行转写,并支持将语音翻译为英文文本。
★ 3 · 更新于 2026-09-16
一款可自动检测内容类型、选择总结深度并支持文本、PDF、音频、图像与视频的多功能总结工具。
★ 0 · 更新于 2026-09-09
使用 songsee 命令行工具从音频生成声谱图与特征面板可视化。
★ 0 · 更新于 2026-09-09
提供在 plyr.fm 上上传、更新、删除、点赞、取消点赞及下载单曲的 CLI 命令指南。
★ 650 · 更新于 2026-09-09
指导用户使用 CLI 在 plyr.fm 上执行曲目上传、更新、删除、点赞和下载等变更操作。
★ 33 · 更新于 2026-03-24
使用Demucs、pyannote和Resemblyzer分离音频中的说话人、对比语音样本并处理音频片段。
★ 25 · 更新于 2026-03-10
Unity 引擎基础与 3D 资产集成工作流
★ 22 · 更新于 2026-02-15
使用Unsloth优化框架微调文本转语音模型,实现语音克隆与语音合成。
★ 276 · 更新于 2026-02-11
生成专业分镜提示词并通过即梦API直接生成视频、自动下载