LogoClawIndex
案例技能关于
LogoClawIndex

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。

使用该输入的 Skills:训练超参数

浏览使用该输入的技能列表。

  • thinkdial-reasoning-effort-control - ThinkDial:控制大语言模型推理力度
    推理预算令牌压缩可控推理预算感知训练

    ★ 6 · 更新于 2026-10-01

    通过预算感知微调和自适应奖励塑形,使用高、中、低模式控制大语言模型的推理力度。

    ⚙ 定义离散推理模式⚙ 设置令牌预算⚙ 执行预算感知监督微调
  • moe-training - 训练稀疏混合专家模型
    混合专家稀疏模型DeepSpeed专家并行

    ★ 3 · 更新于 2026-09-29

    使用 DeepSpeed 或 HuggingFace 训练和优化稀疏混合专家模型,涵盖路由、负载均衡、专家并行和推理优化。

    ⚙ 实现稀疏 MoE 架构⚙ 配置 Top-k 路由⚙ 平衡专家利用率
  • stable-baselines3 - 生产级强化学习算法库
    强化学习机器学习算法PyTorch

    ★ 650 · 更新于 2026-06-30

    基于 PyTorch 的强化学习算法库,支持训练智能体和创建自定义环境

    ⚙ 训练强化学习智能体⚙ 创建自定义环境⚙ 实现回调函数
  • apple-ml - Apple Silicon 机器学习代码模式
    机器学习Apple SiliconPyTorchMLX

    ★ 1 · 更新于 2026-03-25

    为 Apple Silicon M 系列硬件编写 PyTorch 和 MLX 代码,无需 CUDA

    ⚙ 选择设备⚙ 设置内存限制⚙ 监控内存