LogoClawIndex
案例技能关于
LogoClawIndex

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。

使用该输入的 Skills:基础模型

浏览使用该输入的技能列表。

  • verl-rl-training - 大语言模型强化学习训练库
    强化学习RLHFGRPOPPO

    ★ 650 · 更新于 2026-06-30

    提供使用 verl 库对大语言模型进行强化学习训练的指导

    ⚙ 使用 RLHF 训练模型⚙ 使用 GRPO 训练模型⚙ 使用 PPO 训练模型
  • verl-rl-training - 使用verl库训练大语言模型
    强化学习RLHF模型训练分布式计算

    ★ 1 · 更新于 2026-06-30

    支持多种算法和后端的大语言模型灵活强化学习训练库

    ⚙ 使用GRPO算法训练LLM⚙ 使用PPO算法训练LLM⚙ 使用RLOO算法训练LLM
  • verl-rl-training - 使用verl进行LLM强化学习训练
    强化学习RLHFGRPOPPO

    ★ 0 · 更新于 2026-06-30

    使用verl库进行LLM的RLHF、GRPO和PPO强化学习训练

    ⚙ 训练LLM⚙ 配置算法⚙ 准备数据集
  • verl-rl-training - verl LLM强化学习训练框架
    强化学习RLHFGRPOPPO

    ★ 1 · 更新于 2026-06-30

    大语言模型强化学习训练库

    ⚙ 训练模型⚙ 执行rollout⚙ 计算奖励
  • verl-rl-training - 使用 verl 进行 LLM 强化学习训练
    大语言模型强化学习训练分布式系统

    ★ 0 · 更新于 2026-06-30

    使用 verl 库通过强化学习算法训练大语言模型

    ⚙ 实施 RLHF⚙ 配置 GRPO⚙ 运行 PPO
  • local-finetune - 本地 LoRA 微调流水线
    微调本地模型机器学习数据流水线

    ★ 66 · 更新于 2026-06-30

    通过 LoRA 在 Apple Silicon 上将技能嵌入本地模型的流水线

    ⚙ 摄取 Claude 历史⚙ 摄取技能文件⚙ 生成训练对
  • slipstream-finetune - 微调模型以支持Slipstream协议
    大模型微调Slipstream协议GLM-4数据集生成

    ★ 650 · 更新于 2026-03-26

    训练模型使用Slipstream协议进行原生通信

    ⚙ 生成数据集⚙ 微调模型⚙ 测试模型
  • model - AI算法模型开发与微调
    机器学习模型训练微调算法开发

    ★ 22 · 更新于 2026-02-15

    用于数据集设计、模型微调、评估和部署的算法与模型开发技能

    ⚙ 设计数据集⚙ 清理数据集⚙ 执行监督微调
  • unsloth-inference - 使用Unsloth部署微调模型进行生产推理
    模型推理模型部署vllmsglang

    ★ 650 · 更新于 2026-02-14

    使用优化内核和服务引擎部署微调模型进行生产推理

    ⚙ 加载微调模型⚙ 加载分词器⚙ 启用优化内核
  • model - AI模型开发与微调
    AI/ML模型训练微调机器学习

    ★ 650 · 更新于 2026-02-14

    为特定任务和领域开发和微调AI模型。

    ⚙ 设计数据集⚙ 清洗数据⚙ 执行监督微调