Skip to content

[CUDA] Enable native SM90, block_size=32, and fused bias for fpA_intB MatMulNBits - #29585

Merged
tianleiwu merged 1 commit into
mainfrom
tlwu/20260707/fpa_intb_sm90_bs32_bias
Jul 7, 2026
Merged

[CUDA] Enable native SM90, block_size=32, and fused bias for fpA_intB MatMulNBits#29585
tianleiwu merged 1 commit into
mainfrom
tlwu/20260707/fpa_intb_sm90_bs32_bias

[CUDA] Enable native SM90, block_size=32, and fused bias for fpA_intB…

7023483
Select commit
Loading
Failed to load commit list.
GitHub Advanced Security / lintrunner succeeded Jul 7, 2026 in 2s

No new alerts in code changed by this pull request