agent-lightning-rl-training - 为多种智能体提供 Agent Lightning 强化学习训练
捕获智能体状态快照和转移数据,并分解回合回报以支持多种智能体框架中的动作级强化学习更新。
标签
更新于: 2026-09-28能力
典型输入
典型输出
该技能可以做什么
- 捕获智能体状态快照
- 报告执行转移
- 接收转移数据
- 处理强化学习批次
- 分解回合回报
- 分配动作级信用
- 训练跨框架策略
输入
- 智能体框架
- 智能体任务
- 状态快照
- 大语言模型动作
- 奖励
- 转移回合
- 训练模型
输出
- 执行会话 ID
- 已报告的转移数据
- 逐动作奖励
- 强化学习训练更新
