slime-rl-training - 使用 slime 框架进行大模型 RL 后训练。强化学习Megatron-LMSGLangGRPO★ 0 · 更新于 2026-09-24提供使用集成 Megatron-LM 与 SGLang 的 slime 框架进行大模型强化学习后训练的指导与工作流。⚙ 执行标准 GRPO 训练⚙ 运行异步强化学习训练⚙ 进行多轮 Agent 训练
vllm-ascend-model-adapter - 在昇腾NPU上适配vLLM模型昇腾NPUvLLMHugging Face模型适配★ 0 · 更新于 2026-05-11适配并调试Hugging Face或本地模型在昇腾NPU上运行vLLM⚙ 收集模型上下文⚙ 分析模型文件⚙ 实现模型适配器