★ 1 · 更新于 2026-09-15
编写对比张量描述符内核与原始内核的数值等价性测试,并将结果保存至 tests/triton/test_<name>_td.py。
浏览带有该标签的技能列表。
★ 1 · 更新于 2026-09-15
编写对比张量描述符内核与原始内核的数值等价性测试,并将结果保存至 tests/triton/test_<name>_td.py。
★ 602 · 更新于 2026-06-30
按照 PyTorch 的 Sphinx/reStructuredText 规范为函数和方法编写 docstring。
★ 18 · 更新于 2026-06-30
通过 PyTorch SDPA、flash-attn 库、H100 FP8 及滑动窗口注意力优化 Transformer 注意力机制。
★ 602 · 更新于 2026-06-30
基于 PyTorch 的强化学习算法库,支持训练智能体和创建自定义环境
★ 23 · 更新于 2026-06-30
基于PyTorch的强化学习算法,用于训练智能体、创建自定义环境、实现回调和优化训练工作流
★ 602 · 更新于 2026-06-30
在 Apple Silicon 上为 PyTorch 操作符实现 Metal/MPS 内核
★ 0 · 更新于 2026-06-30
使用原生 c10/metal 基础设施为 PyTorch 操作实现 Metal/MPS 内核
★ 4,344 · 更新于 2026-06-15
列举常见 PyTorch 错误并提供实战验证的训练模式和优化技巧
★ 18 · 更新于 2026-05-11
将 GitHub issues 路由到团队并添加标签
★ 602 · 更新于 2026-05-11
将 GitHub 问题分流到值班团队,应用标签并关闭咨询类问题
★ 1 · 更新于 2026-03-25
为 Apple Silicon M 系列硬件编写 PyTorch 和 MLX 代码,无需 CUDA
★ 18 · 更新于 2026-03-20
完整的机器学习环境,用于模型训练、GPU加速和数据科学工作流
★ 581 · 更新于 2026-03-10
将基于自注意力的Counter_Guide模块与自适应权重集成到双分支ViT中,实现RGB/事件数据融合
★ 0 · 更新于 2026-03-10
按照最佳实践设计和实现PyTorch模块,优化内存、分布式训练和性能。
★ 2 · 更新于 2026-02-13
为动力学系统与控制应用训练神经网络
★ 18 · 更新于 2026-02-11
该技能通过Basilica CLI帮助访问高性能GPU,用于机器学习训练、分布式作业和计算资源管理
★ 602 · 更新于 2026-02-11
在Basilica去中心化GPU市场上管理GPU租用、ML训练作业和计算资源