LogoClawIndex
案例技能关于
LogoClawIndex

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。

使用该输入的 Skills:Base language model

浏览使用该输入的技能列表。

  • grpo-rl-training - 使用 GRPO 和 TRL 训练语言模型
    后训练强化学习GRPOTRL

    ★ 1 · 更新于 2026-10-03

    提供使用 TRL、定制奖励函数和任务特定训练流程实现 GRPO 强化学习微调的指导。

    ⚙ 准备聊天格式数据集⚙ 定义组合奖励函数⚙ 配置 GRPO 训练