Skip to content

Add support for candle-flash-attn and candle-flash-attn-v3 in CUDA - #14

Merged
alvarobartt merged 6 commits into
add-missing-laya-variantsfrom
add-flash-attention
Sep 25, 2026
Merged

alvarobartt merged 6 commits into
add-missing-laya-variantsfrom
add-flash-attention

Use `flash-attn-2` for Hopper in `Dockerfile.cuda`

2e821f3
Select commit
Loading
Failed to load commit list.
Sign in for the full log view