audio-transcriber - 将音频转录为结构化 Markdown
转录音频或视频,提取元数据,并生成 Markdown 转录稿、会议纪要和摘要。
标签
更新于: 2026-09-29能力
典型输入
典型输出
该技能可以做什么
- 转录音频录音
- 提取录音元数据
- 识别对话说话人
- 生成会议纪要
- 创建执行摘要
- 生成 SRT 和 VTT 字幕
- 转换不支持的音频格式
输入
- 音频或视频文件
- 音频或视频 URL
- 自定义处理提示词
输出
- Markdown 转录报告
- Markdown 会议纪要
- 执行摘要
- SRT 字幕文件
- VTT 字幕文件
- 转录元数据
- 转换后的 WAV 文件
要求
- Python 3
- Faster-Whisper 或 Whisper
- 用于格式转换的 ffmpeg
- 用于智能摘要的 AI 模型
