LogoClawIndex
案例技能关于
LogoClawIndex

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。

使用该输入的 Skills:model checkpoint

浏览使用该输入的技能列表。

  • verl-rl-training - 大语言模型强化学习训练库
    强化学习RLHFGRPOPPO

    ★ 650 · 更新于 2026-06-30

    提供使用 verl 库对大语言模型进行强化学习训练的指导

    ⚙ 使用 RLHF 训练模型⚙ 使用 GRPO 训练模型⚙ 使用 PPO 训练模型
  • verl-rl-training - 使用verl库训练大语言模型
    强化学习RLHF模型训练分布式计算

    ★ 1 · 更新于 2026-06-30

    支持多种算法和后端的大语言模型灵活强化学习训练库

    ⚙ 使用GRPO算法训练LLM⚙ 使用PPO算法训练LLM⚙ 使用RLOO算法训练LLM
  • vllm-ascend-model-adapter - vLLM Ascend 模型适配
    模型适配Ascend NPUvLLM推理

    ★ 60 · 更新于 2026-05-11

    为 vLLM 在 Ascend NPU 上适配和调试模型

    ⚙ 分析模型架构⚙ 实现模型适配器⚙ 添加处理器支持
  • miles-rl-training - 企业级强化学习训练框架
    强化学习MoEFP8INT4

    ★ 650 · 更新于 2026-05-11

    面向大规模MoE模型的企业级强化学习训练框架,支持FP8/INT4精度训练

    ⚙ 训练MoE模型⚙ 配置FP8训练⚙ 配置INT4训练