LogoClawIndex
CasesSkillsAbout
LogoClawIndex

rocm-kernels - Optimize Triton kernels for AMD ROCm pipelines

Guides development, integration, benchmarking, and debugging of optimized Triton kernels for AMD GPUs on ROCm.

Tags

Updated: 2026-10-07

Capabilities

Typical Inputs

Typical Outputs

What this skill does

  • Write optimized Triton kernels
  • Benchmark kernel performance
  • Integrate diffusers pipelines
  • Optimize AMD GPU kernels
  • Debug ROCm/HIP issues

Inputs

  • Kernel type
  • Triton or PyTorch source code
  • HuggingFace pipeline or model
  • Benchmark parameters
  • AMD GPU target

Outputs

  • Kernel implementation guidance
  • Benchmark measurements
  • JSON benchmark results
  • Pipeline with injected kernels

Requirements

  • ROCm environment
  • AMD MI355X or R9700 GPU
  • Triton
  • PyTorch
  • HuggingFace diffusers or transformers

Source

  • Spec: SKILL.md

ClawIndex

OpenClaw Skills & Use Case Index

ClawIndex is an ecosystem-driven index of OpenClaw skills and real-world use cases.

Index

Skills·
Cases

Meta

About·
Disclaimer·
Email·
GitHub
© 2026 ClawIndex All Rights Reserved.
ROCm
Triton
AMD GPU
diffusers
transformers
kernel optimization
benchmarking
Write optimized Triton kernels
Benchmark kernel performance
Integrate diffusers pipelines
Optimize AMD GPU kernels
Kernel type
Triton or PyTorch source code
HuggingFace pipeline or model
Kernel implementation guidance
Benchmark measurements
JSON benchmark results