LogoClawIndex
案例技能关于
LogoClawIndex

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。

使用该输入的 Skills:训练配置

浏览使用该输入的技能列表。

  • verl-rl-training - 大语言模型强化学习训练库
    强化学习RLHFGRPOPPO

    ★ 602 · 更新于 2026-06-30

    提供使用 verl 库对大语言模型进行强化学习训练的指导

    ⚙ 使用 RLHF 训练模型⚙ 使用 GRPO 训练模型⚙ 使用 PPO 训练模型
  • verl-rl-training - 使用Verl的大语言模型强化学习训练
    强化学习RLHF后训练分布式训练

    ★ 0 · 更新于 2026-06-30

    使用verl通过PPO、GRPO等强化学习算法大规模训练大语言模型

    ⚙ 使用PPO训练模型⚙ 使用GRPO训练模型⚙ 配置强化学习算法
  • verl-rl-training - 使用verl库训练大语言模型
    强化学习RLHF模型训练分布式计算

    ★ 1 · 更新于 2026-06-30

    支持多种算法和后端的大语言模型灵活强化学习训练库

    ⚙ 使用GRPO算法训练LLM⚙ 使用PPO算法训练LLM⚙ 使用RLOO算法训练LLM
  • verl-rl-training - 使用verl进行LLM强化学习训练
    强化学习RLHFGRPOPPO

    ★ 0 · 更新于 2026-06-30

    使用verl库进行LLM的RLHF、GRPO和PPO强化学习训练

    ⚙ 训练LLM⚙ 配置算法⚙ 准备数据集
  • verl-rl-training - verl LLM强化学习训练框架
    强化学习RLHFGRPOPPO

    ★ 1 · 更新于 2026-06-30

    大语言模型强化学习训练库

    ⚙ 训练模型⚙ 执行rollout⚙ 计算奖励
  • stable-baselines3 - 使用 Stable Baselines3 训练强化学习智能体
    强化学习机器学习智能体训练RL 算法

    ★ 16 · 更新于 2026-06-15

    使用基于 PyTorch 的库实现强化学习算法并训练智能体

    ⚙ 训练强化学习智能体⚙ 创建自定义环境⚙ 实现回调函数
  • pytorch-lightning - PyTorch Lightning 训练框架
    PyTorch Lightning训练框架分布式训练ddp

    ★ 0 · 更新于 2026-05-28

    用于分布式训练的高级 PyTorch 框架,支持 DDP/FSDP/DeepSpeed

    ⚙ 训练模型⚙ 验证模型⚙ 测试模型
  • miles-rl-training - 企业级强化学习训练框架
    强化学习MoEFP8INT4

    ★ 602 · 更新于 2026-05-11

    面向大规模MoE模型的企业级强化学习训练框架,支持FP8/INT4精度训练

    ⚙ 训练MoE模型⚙ 配置FP8训练⚙ 配置INT4训练
  • numerai-model-implementation - 为Numerai训练实现新模型类型
    机器学习numerai模型实现训练管道

    ★ 0 · 更新于 2026-02-18

    添加新的模型类型到训练管道中

    ⚙ 在工厂中注册模型⚙ 定义模型API⚙ 更新训练配置
  • numerai-model-implementation - 为训练管道添加新的Numerai模型类型
    numerai建模机器学习训练

    ★ 1,094 · 更新于 2026-02-18

    为Numerai智能体训练管道添加新模型类型以进行训练和评估

    ⚙ 在模型工厂注册模型⚙ 处理fit/predict特性⚙ 更新模型配置
  • model - AI算法模型开发与微调
    机器学习模型训练微调算法开发

    ★ 18 · 更新于 2026-02-15

    用于数据集设计、模型微调、评估和部署的算法与模型开发技能

    ⚙ 设计数据集⚙ 清理数据集⚙ 执行监督微调