ai-security - 评估 AI 与 LLM 系统的安全风险
评估 AI/ML 系统的提示注入、越狱、模型反演、数据投毒、智能体工具滥用风险,并映射 MITRE ATLAS 技术。
标签
更新于: 2026-10-03能力
典型输入
典型输出
该技能可以做什么
- 扫描提示中的注入特征
- 评估越狱抵抗能力
- 评估模型反演风险
- 评估数据投毒风险
- 检测智能体工具滥用
- 将发现映射至 MITRE ATLAS
- 推荐防护栏控制措施
输入
- 测试提示
- 提示测试文件
- 目标类型
- 访问级别
- 威胁类别范围
- 书面授权
输出
- 注入发现
- 风险评分
- 越狱评估结果
- MITRE ATLAS 映射
- 防护栏建议
- 进程退出状态
要求
- Python 3 运行环境
- AI 威胁扫描工具
- 灰盒或白盒测试的书面授权
