Skip to content

[Feat] add chunked-attention kernels on Hopper (for llama4) - #4291

Merged
schetlur-nv merged 3 commits into
NVIDIA:mainfrom
PerkzZheng:user/perkzz/chunked-attention
May 19, 2025
Merged

[Feat] add chunked-attention kernels on Hopper (for llama4)#4291
schetlur-nv merged 3 commits into
NVIDIA:mainfrom
PerkzZheng:user/perkzz/chunked-attention

Commits

Commits on May 19, 2025