optimize-model - Optimize KServe model inference performance
Analyze model code and deployment config to identify CPU/GPU optimization opportunities for KServe inference services
Tags
Updated: 2026-05-28Capabilities
Typical Inputs
What this skill does
- Read model server code
- Read deployment chart
- Fetch upstream guidelines
- Analyze inference backend
- Check GPU/CPU settings
- Generate optimization report
Inputs
- Model name
- Model source code
- Deployment chart values
- Requirements files
- Model documentation
Outputs
- Performance findings
- Optimization recommendations
- Configuration diffs
Requirements
- Model repository access
- Deployment chart access
- Web fetch capability
