ai-security - AI/ML 与 LLM Agent 安全评估
评估 AI/ML 系统与 LLM Agent 的提示注入、越狱、模型反演、数据投毒和工具滥用风险。
标签
更新于: 2026-10-03该技能可以做什么
- 检测注入特征
- 评估越狱抵抗能力
- 评估模型反演风险
- 评估数据投毒风险
- 映射 MITRE ATLAS 技术
- 评估 Agent 工具滥用
- 推荐护栏控制措施
输入
- 测试提示
- 提示测试文件
- 目标类型
- 访问级别
- 威胁范围
- 书面授权
输出
- 注入检测结果
- 风险评分
- MITRE ATLAS 映射
- 护栏建议
- 扫描器退出状态
- JSON 扫描报告
要求
- Python 3 运行环境
- AI 威胁扫描器脚本
- 灰盒或白盒测试的书面授权
