ai-security - 评估 AI 与 LLM 安全风险
评估 AI/ML 系统中的提示注入、越狱、模型反演、数据投毒和智能体工具滥用风险。
标签
更新于: 2026-10-03能力
典型输入
典型输出
该技能可以做什么
- 扫描提示注入特征
- 评估越狱抵抗能力
- 评估模型反演风险
- 评估数据投毒风险
- 检测智能体工具滥用
- 映射 MITRE ATLAS 技术
- 推荐防护栏控制
- 列出注入特征
输入
- 测试提示
- 提示测试文件
- 目标类型
- 访问级别
- 威胁类别范围
- 书面测试授权
输出
- 注入检测结果
- 风险评分
- MITRE ATLAS 映射
- 防护栏控制建议
- 注入特征列表
- 扫描器退出状态
要求
- Python 3 运行环境
- 灰盒或白盒测试的书面授权
