Skip to content

llama: use f16 mask for FA to save VRAM - #23764

Merged
am17an merged 3 commits into
ggml-org:masterfrom
am17an:kq_mask_f16
May 29, 2026
Merged

am17an merged 3 commits into
ggml-org:masterfrom
am17an:kq_mask_f16