★ 17 · 更新于 2026-09-21
使用 Hugging Face TRL、Axolotl、DeepSpeed 或 FSDP 构建 QLoRA、LoRA 与全量 LLM 微调基础设施。
浏览使用该输入的技能列表。
★ 17 · 更新于 2026-09-21
使用 Hugging Face TRL、Axolotl、DeepSpeed 或 FSDP 构建 QLoRA、LoRA 与全量 LLM 微调基础设施。
★ 602 · 更新于 2026-06-30
提供使用 verl 库对大语言模型进行强化学习训练的指导
★ 0 · 更新于 2026-06-30
使用verl通过PPO、GRPO等强化学习算法大规模训练大语言模型
★ 1 · 更新于 2026-06-30
支持多种算法和后端的大语言模型灵活强化学习训练库
★ 1 · 更新于 2026-06-30
大语言模型强化学习训练库
★ 0 · 更新于 2026-06-30
使用 verl 库通过强化学习算法训练大语言模型
★ 11 · 更新于 2026-06-30
深入分析通过知识蒸馏将大型模型压缩为高效小模型的技术
★ 3,789 · 更新于 2026-06-15
列举常见 PyTorch 错误并提供实战验证的训练模式和优化技巧
★ 3 · 更新于 2026-05-28
高级 PyTorch 框架,支持自动分布式训练和最少样板代码
★ 602 · 更新于 2026-05-09
使用交叉验证、超参数调优和管道训练 scikit-learn 机器学习模型
★ 602 · 更新于 2026-03-26
训练模型使用Slipstream协议进行原生通信
★ 602 · 更新于 2026-03-26
使用Unsloth通过4-bit量化和LoRA微调大语言模型
★ 15 · 更新于 2026-03-26
构建计算机视觉系统,实现实时目标检测、图像分割和OCR部署
★ 602 · 更新于 2026-03-22
检测AI系统中的系统性偏差,确保预测在受保护属性上不会出现不公平的差异
★ 11 · 更新于 2026-03-21
配备CUDA的PyTorch机器学习环境,支持模型训练和GPU加速
★ 2 · 更新于 2026-03-10
提供跨多GPU和节点扩展ML训练的并行策略指导
★ 2,781 · 更新于 2026-02-18
使用ai-ethics-validator插件验证AI/ML模型和数据集的伦理影响与公平性
★ 2 · 更新于 2026-02-13
为动力学系统与控制应用训练神经网络