ai-security - 评估 AI 与 LLM 安全风险
扫描 AI/ML 系统中的提示注入、越狱、模型反演、数据投毒和智能体工具滥用,并映射至 MITRE ATLAS。
标签
更新于: 2026-10-03能力
典型输入
典型输出
该技能可以做什么
- 扫描提示注入特征
- 评估越狱抵抗能力
- 评估模型反演风险
- 评估数据投毒风险
- 检测智能体工具滥用
- 映射 MITRE ATLAS 技术
- 推荐防护栏控制措施
输入
- 测试提示词
- 提示词测试文件
- 目标类型
- 访问级别
- 威胁范围
- 测试授权
输出
- 注入检测结果
- 风险评分
- ATLAS 技术映射
- 防护栏建议
- 扫描器退出状态
要求
- Python 3
- AI 威胁扫描器脚本
- 灰盒访问的书面授权
- 白盒访问的书面授权
