★ 0 · 更新于 2026-05-11
适配并调试Hugging Face或本地模型在昇腾NPU上运行vLLM
浏览使用该输入的技能列表。
★ 0 · 更新于 2026-05-11
适配并调试Hugging Face或本地模型在昇腾NPU上运行vLLM
★ 0 · 更新于 2026-05-11
适配和调试模型在Ascend NPU上运行vLLM
★ 60 · 更新于 2026-05-11
为 vLLM 在 Ascend NPU 上适配和调试模型
★ 650 · 更新于 2026-05-11
为机器学习模型生成部署产物,包括API、容器化、监控和A/B测试基础设施
★ 22 · 更新于 2026-03-23
通过OOM重试和自动卸载管理多服务GPU显存共享