LogoClawIndex
案例技能关于
LogoClawIndex

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。

产出该输出的 Skills:Trained model

浏览产出该输出的技能列表。

  • grpo-rl-training - 使用 GRPO 和 TRL 训练语言模型
    后训练强化学习GRPOTRL

    ★ 1 · 更新于 2026-10-03

    提供使用 TRL、定制奖励函数和任务特定训练流程实现 GRPO 强化学习微调的指导。

    ⚙ 准备聊天格式数据集⚙ 定义组合奖励函数⚙ 配置 GRPO 训练
  • verl-rl-training - 使用verl进行LLM强化学习训练
    强化学习RLHFGRPOPPO

    ★ 0 · 更新于 2026-06-30

    使用verl库进行LLM的RLHF、GRPO和PPO强化学习训练

    ⚙ 训练LLM⚙ 配置算法⚙ 准备数据集
  • skypilot-multi-cloud-orchestration - SkyPilot 多云机器学习编排
    基础设施多云编排GPU

    ★ 650 · 更新于 2026-06-15

    跨多个云平台运行机器学习工作负载并优化成本

    ⚙ 启动集群⚙ 执行任务⚙ 运行分布式训练
  • ml-pipeline-workflow - 构建端到端 ML 管道
    ML 管道MLOps数据准备模型训练

    ★ 1 · 更新于 2026-03-24

    从数据准备到模型部署编排 ML 工作流

    ⚙ 设计管道架构⚙ 编排 DAG 工作流⚙ 验证数据质量