Skip to content

ggml-cuda: widen Q4_K MMVQ weight loads to global_load_b128 - #88

Open
Annieren wants to merge 1 commit into
gfx11from
annier.q4_k-mmvq-b128
Open

ggml-cuda: widen Q4_K MMVQ weight loads to global_load_b128#88
Annieren wants to merge 1 commit into
gfx11from
annier.q4_k-mmvq-b128

Commits

Commits on Aug 17, 2026