Search

NVIDIA AI Platform · By ZJLi2013

8 skills found.
Search results
#SkillRepositoryStarsUsed inTokensAuto-checkLicenceUpdated
1

Optimize fused cross-entropy loss kernels in Triton for NVIDIA and AMD GPUs.

ZJLi2013/awesome-kernel-skills102—~461Automated safety check: PassNo licence6 mo ago
2

Optimize FlashAttention-style fused attention kernels in Triton for NVIDIA and AMD GPUs.

ZJLi2013/awesome-kernel-skills102—~697Automated safety check: PassNo licence6 mo ago
3

Optimize Fused Mixture-of-Experts (MoE) kernels in Triton for NVIDIA and AMD GPUs.

ZJLi2013/awesome-kernel-skills102—~699Automated safety check: PassNo licence6 mo ago
4

Optimize dense matrix multiplication (GEMM) kernels in Triton for NVIDIA and AMD GPUs.

ZJLi2013/awesome-kernel-skills102—~1.1kAutomated safety check: PassNo licence6 mo ago
5

Profile GPU kernels using NCU (NVIDIA) or rocprof (AMD) to collect performance metrics.

ZJLi2013/awesome-kernel-skills102—~696Automated safety check: PassNo licence6 mo ago
6

Optimize RMS Normalization kernels in Triton for NVIDIA and AMD GPUs.

ZJLi2013/awesome-kernel-skills102—~728Automated safety check: PassNo licence6 mo ago
7

Optimize fused softmax kernels in Triton for NVIDIA and AMD GPUs.

ZJLi2013/awesome-kernel-skills102—~742Automated safety check: PassNo licence6 mo ago
8

Optimize Rotary Position Embedding (RoPE) kernels in Triton for NVIDIA and AMD GPUs.

ZJLi2013/awesome-kernel-skills102—~421Automated safety check: PassNo licence6 mo ago