LogoClawIndex
案例技能关于
LogoClawIndex

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。

带有该标签的 Skills:Megatron-LM

浏览带有该标签的技能列表。

  • slime-rl-training - 使用 slime 框架进行大模型 RL 后训练。
    强化学习Megatron-LMSGLangGRPO

    ★ 1 · 更新于 2026-09-24

    提供使用集成 Megatron-LM 与 SGLang 的 slime 框架进行大模型强化学习后训练的指导与工作流。

    ⚙ 执行标准 GRPO 训练⚙ 运行异步强化学习训练⚙ 进行多轮 Agent 训练
  • verl-rl-training - verl LLM强化学习训练框架
    强化学习RLHFGRPOPPO

    ★ 2 · 更新于 2026-06-30

    大语言模型强化学习训练库

    ⚙ 训练模型⚙ 执行rollout⚙ 计算奖励
  • miles-rl-training - 企业级强化学习训练框架
    强化学习MoEFP8INT4

    ★ 666 · 更新于 2026-05-11

    面向大规模MoE模型的企业级强化学习训练框架,支持FP8/INT4精度训练

    ⚙ 训练MoE模型⚙ 配置FP8训练⚙ 配置INT4训练