LogoClawIndex
CasesSkillsAbout
LogoClawIndex

ClawIndex

OpenClaw Skills & Use Case Index

ClawIndex is an ecosystem-driven index of OpenClaw skills and real-world use cases.

Index

Skills·
Cases

Meta

About·
Disclaimer·
Email·
GitHub
© 2026 ClawIndex All Rights Reserved.

Skills tagged: Post-Training

Browse skills that share this tag.

  • fine-tuning-with-trl - Post-training and preference alignment for LLMs with TRL
    Post-TrainingTRLReinforcement LearningFine-Tuning

    ★ 0 · Updated 2026-09-24

    Provides methods and workflows for LLM post-training, including SFT, DPO, PPO, GRPO, and reward modeling.

    ⚙ Execute supervised fine-tuning⚙ Train reward models⚙ Align models using DPO
  • slime-rl-training - LLM RL post-training using Megatron-LM and SGLang.
    Reinforcement LearningMegatron-LMSGLangGRPO

    ★ 1 · Updated 2026-09-24

    Provides guidance and workflows for LLM post-training with RL using the slime framework integrating Megatron-LM and SGLang.

    ⚙ Execute standard GRPO training⚙ Run asynchronous RL training⚙ Conduct multi-turn agentic training
  • simpo - Simple Preference Optimization
    Post-TrainingSimPOPreference OptimizationAlignment

    ★ 9 · Updated 2026-09-16

    Executes reference-free preference optimization for language model post-training without requiring a reference model.

    ⚙ Train base models with SimPO⚙ Fine-tune instruct models⚙ Optimize reasoning intensive tasks
  • verl-rl-training - RL Training Library for LLMs
    Reinforcement LearningRLHFGRPOPPO

    ★ 650 · Updated 2026-06-30

    Provides guidance for training LLMs with RL using verl library

    ⚙ train models with RLHF⚙ train models with GRPO⚙ train models with PPO
  • verl-rl-training - LLM Reinforcement Learning Training with Verl
    Reinforcement LearningRLHFPost-TrainingDistributed Training

    ★ 0 · Updated 2026-06-30

    Train LLMs at scale using verl with PPO, GRPO, and other RL algorithms

    ⚙ train models with PPO⚙ train models with GRPO⚙ configure RL algorithms
  • verl-rl-training - LLM Reinforcement Learning Training with verl
    Reinforcement LearningRLHFGRPOPPO

    ★ 0 · Updated 2026-06-30

    Train LLMs with RLHF, GRPO, and PPO using verl library

    ⚙ train LLMs⚙ configure algorithm⚙ prepare dataset
  • verl-rl-training - verl: LLM RL Training Framework
    Reinforcement LearningRLHFGRPOPPO

    ★ 1 · Updated 2026-06-30

    Flexible RL training library for large language models

    ⚙ train models⚙ run rollout⚙ compute reward