LogoClawIndex
案例技能关于
LogoClawIndex

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。

使用该输入的 Skills:Training configuration

浏览使用该输入的技能列表。

  • alterlab-pufferlib - 使用 PufferLib 扩展强化学习训练
    强化学习PufferLibPPO向量化环境

    ★ 22 · 更新于 2026-10-03

    使用 PufferLib 通过并行向量化环境、原生多智能体支持、自定义 PufferEnv 任务和环境集成训练强化学习智能体。

    ⚙ 训练 PPO 智能体⚙ 创建 PufferEnv 任务⚙ 向量化环境模拟
  • grpo-rl-training - 使用 GRPO 和 TRL 训练语言模型
    后训练强化学习GRPOTRL

    ★ 1 · 更新于 2026-10-03

    提供使用 TRL、定制奖励函数和任务特定训练流程实现 GRPO 强化学习微调的指导。

    ⚙ 准备聊天格式数据集⚙ 定义组合奖励函数⚙ 配置 GRPO 训练
  • fine-tuning-serving-openpi - 微调并服务 OpenPI 机器人策略
    OpenPIPhysical Intelligence视觉语言动作机器人技术

    ★ 85 · 更新于 2026-09-28

    使用 JAX 或 PyTorch 微调和服务 Physical Intelligence OpenPI 模型,用于 ALOHA、DROID 和 LIBERO 环境中的机器人策略推理。

    ⚙ 微调 OpenPI 模型⚙ 服务策略推理⚙ 转换 JAX 检查点
  • fine-tuning-with-trl - 使用 TRL 进行大语言模型后训练与偏好对齐
    后训练TRL强化学习微调

    ★ 0 · 更新于 2026-09-24

    提供大语言模型后训练的方法与工作流,涵盖 SFT、DPO、PPO、GRPO 及奖励模型训练。

    ⚙ 执行监督微调⚙ 训练奖励模型⚙ 使用 DPO 对齐模型
  • numerai-model-implementation - 为训练管道添加新的Numerai模型类型
    numerai建模机器学习训练

    ★ 1,182 · 更新于 2026-02-18

    为Numerai智能体训练管道添加新模型类型以进行训练和评估

    ⚙ 在模型工厂注册模型⚙ 处理fit/predict特性⚙ 更新模型配置
  • model - AI算法模型开发与微调
    机器学习模型训练微调算法开发

    ★ 22 · 更新于 2026-02-15

    用于数据集设计、模型微调、评估和部署的算法与模型开发技能

    ⚙ 设计数据集⚙ 清理数据集⚙ 执行监督微调