ai-accelerators - AI加速器优化
针对GPU、TPU和边缘设备的机器学习硬件加速策略
标签
更新于: 2026-06-30能力
典型输入
典型输出
该技能可以做什么
- 优化CUDA内存
- 利用Tensor核心
- 配置多GPU环境
- 运行TPU训练
- 部署边缘模型
- 转换TFLite模型
- 自动调优硬件
- 基准测试性能
输入
- GPU/TPU硬件
- 机器学习模型
- 训练数据
- ONNX模型文件
- TFLite模型文件
输出
- 优化后的模型
- TensorRT引擎
- Edge TPU模型
- 性能指标
- 硬件建议
要求
- AI加速器硬件
- CUDA/ROCm运行时
- PyTorch或JAX
- TensorRT或XLA
- 边缘设备支持
