audio-transcriber - 将音频转为结构化 Markdown 文档
转录音频录音、提取元数据,并借助 LLM 生成 Markdown 转录稿、会议纪要和执行摘要。
标签
更新于: 2026-09-30能力
典型输入
典型输出
该技能可以做什么
- 检测转录引擎
- 验证音频文件
- 提取音频元数据
- 转换不支持的格式
- 转录音频录音
- 识别对话说话人
- 生成会议纪要
- 生成执行摘要
- 写入 Markdown 文档
输入
- 音频文件路径
- 音频文件 URL
- 自定义处理提示词
输出
- Markdown 转录报告
- 会议纪要文件
- 执行摘要
- 音频元数据
- 转换后的 WAV 文件
要求
- Python 3
- Faster-Whisper 或 Whisper
- 用于格式转换的 ffmpeg
- 用于摘要生成的 LLM 支持
- 本地文件或网络访问权限
