LogoClawIndex
案例技能关于
LogoClawIndex

ClawIndex

OpenClaw Skills 与 Use Case 索引

ClawIndex 是一个生态驱动的 OpenClaw Skills 与真实 Use Case 索引站。

索引

Skills·
Cases

Meta

关于·
声明·
邮箱·
GitHub
© 2026 ClawIndex 保留所有权利。

agent-validation-v430 - 带安全控制的有效代理训练

通过禁用有害操作和分层安全门训练代理有效行动

标签

更新于: 2026-05-09
机器学习代理训练强化学习安全控制

能力

典型输入

典型输出

该技能可以做什么

  • 禁用熵调整
  • 保存最佳检查点
  • 咨询代理
  • 应用操作
  • 调整奖励权重
  • 设置分层门限
  • 注入跨运行学习
  • 回滚模型
  • 停止训练

输入

  • 检查点路径
  • 训练环境
  • 代理指标

输出

  • 模型检查点
  • 训练状态
  • 奖励权重更新
  • 终止信号

要求

  • Python 3.10
  • PPO强化学习
  • GPU环境

来源

  • 规范: SKILL.md
禁用熵调整
保存最佳检查点
咨询代理
应用操作
检查点路径
训练环境
代理指标
模型检查点
训练状态
奖励权重更新