ai-security - 评估 AI 与大语言模型安全风险
评估 AI/ML 系统的提示注入、越狱、模型反演、数据投毒和智能体工具滥用风险,并映射 MITRE ATLAS 技术。
标签
更新于: 2026-10-03能力
典型输入
典型输出
该技能可以做什么
- 扫描提示注入特征
- 评估越狱抵抗能力
- 评估模型反演风险
- 评估数据投毒风险
- 检测智能体工具滥用
- 映射 MITRE ATLAS 技术
- 推荐防护栏控制措施
输入
- 测试提示
- 提示测试文件
- 目标类型
- 访问级别
- 威胁范围
- 授权状态
输出
- 扫描发现
- 风险评分
- MITRE ATLAS 映射
- 防护栏建议
- 退出状态
要求
- Python 3 运行环境
- 测试提示访问权限
- 灰盒测试的书面授权
- 白盒测试的书面授权
