agent-validation-v430 - 带安全控制的有效代理训练
通过禁用有害操作和分层安全门训练代理有效行动
标签
更新于: 2026-05-09能力
典型输入
典型输出
该技能可以做什么
- 禁用熵调整
- 保存最佳检查点
- 咨询代理
- 应用操作
- 调整奖励权重
- 设置分层门限
- 注入跨运行学习
- 回滚模型
- 停止训练
输入
- 检查点路径
- 训练环境
- 代理指标
输出
- 模型检查点
- 训练状态
- 奖励权重更新
- 终止信号
要求
- Python 3.10
- PPO强化学习
- GPU环境
通过禁用有害操作和分层安全门训练代理有效行动
标签
更新于: 2026-05-09能力
典型输入
典型输出