audiocraft-audio-generation - 使用 AudioCraft 生成音乐与声音
使用 AudioCraft 模型根据文本生成音乐和音效,并支持旋律或风格条件控制。
标签
更新于: 2026-10-01能力
典型输入
典型输出
该技能可以做什么
- 根据文本生成音乐
- 生成声音效果
- 生成旋律条件音乐
- 生成立体声音频
- 生成风格条件音乐
- 基于输入延续音频
- 使用 EnCodec 压缩音频
输入
- 文本描述
- 旋律音频
- 风格参考音频
- 待延续音频
- 生成参数
- 预训练模型检查点
输出
- 生成的音频波形
- WAV 音频文件
- 立体声音频输出
要求
- AudioCraft 软件包
- PyTorch 2.0.0 或更高版本
- Transformers 4.30.0 或更高版本
- torchaudio
