Skip to content

Inference: Optimized triton kernels to extract mamba states in prefix caching - #5866

Merged
sidsingh-nvidia merged 5 commits into
NVIDIA:mainfrom
sidsingh-nvidia:siddharth/mamba-fused-intermediate-extraction
Jul 25, 2026
Merged

Inference: Optimized triton kernels to extract mamba states in prefix caching#5866
sidsingh-nvidia merged 5 commits into
NVIDIA:mainfrom
sidsingh-nvidia:siddharth/mamba-fused-intermediate-extraction

Commits

Commits on Jul 17, 2026

Commits on Jul 21, 2026

Commits on Jul 23, 2026