★ 602 · 更新于 2026-06-30
提供使用 verl 库对大语言模型进行强化学习训练的指导
浏览产出该输出的技能列表。
★ 602 · 更新于 2026-06-30
提供使用 verl 库对大语言模型进行强化学习训练的指导
★ 0 · 更新于 2026-06-30
自主运行机器学习实验,修改训练代码、训练模型、评估结果并迭代
★ 0 · 更新于 2026-06-30
使用verl通过PPO、GRPO等强化学习算法大规模训练大语言模型
★ 1 · 更新于 2026-06-30
支持多种算法和后端的大语言模型灵活强化学习训练库
★ 0 · 更新于 2026-06-30
使用verl库进行LLM的RLHF、GRPO和PPO强化学习训练
★ 0 · 更新于 2026-06-30
使用 verl 库通过强化学习算法训练大语言模型
★ 602 · 更新于 2026-05-11
使用 azure-ai-projects SDK 在 Microsoft Foundry 上构建 AI 应用
★ 18 · 更新于 2026-05-11
比较实际代码实现与规范要求,识别偏差
★ 602 · 更新于 2026-05-11
将代码与规范要求进行比较以识别偏差
★ 602 · 更新于 2026-05-09
在 REPL 中评估 Clojure 表达式,用于迭代开发、调试和代码验证
★ 0 · 更新于 2026-05-09
在 REPL 中评估 Clojure 表达式,用于迭代开发和测试
★ 18 · 更新于 2026-05-09
在 REPL 中评估 Clojure 表达式以进行迭代开发和调试
★ 3 · 更新于 2026-03-26
检测非法税务避税、Part IVA触发因素、循环安排和虚假交易
★ 816 · 更新于 2026-03-25
评估扫描结果以符合14个安全框架,生成SBOM和合规报告
★ 182 · 更新于 2026-03-24
编码前搜索现有工具、库和模式的工作流
★ 45 · 更新于 2026-03-23
在归档前验证实现的完整性、正确性和一致性是否与变更文档匹配。
★ 0 · 更新于 2026-03-22
评估 Kubernetes etcd 集群安全态势,检查加密、TLS、访问控制和网络隔离
★ 57 · 更新于 2026-03-19
根据安全策略评估OpenClaw技能
★ 9 · 更新于 2026-03-09
设计、优化和评估提示词,以最大化LLM在各种用例中的性能
★ 1 · 更新于 2026-03-09
设计、优化和评估提示词,以在各种使用场景中最大化LLM性能
Scroll to load more