llama.cpp

mirror of https://github.com/ggml-org/llama.cpp.git synced 2026-05-10 02:54:06 +00:00

Files

lhez 94eeb5967c opencl: add flattened q6_K mv (#19054 )

* opencl: flatten `q6_K` and add `kernel_mul_mv_q6_K_f32_flat`

* opencl: clean up

* opencl: refactor q6_K mv - put loop body in `block_q_6_K_dot_y_flat`

* opencl: tweak the workgroup size a bit

* opencl: output 4 values per subgroup for `kernel_mul_mv_q6_K_f32_flat`

* opencl: proper alignment for q6_K

* opencl: boundary handling for flattened q6_K mv

* opencl: rename q6_K mv kernel file

* opencl: put flattened q6_K mv in its own file

* opencl: use lower k in file name

* opencl: use K in variable names

2026-01-26 19:36:24 -08:00

cmake

ggml: Skip backend library linking code when GGML_BACKEND_DL=ON (#15094 )

2025-08-07 13:45:41 +02:00

include

ggml : add ggml_build_forward_select (#18550 )

2026-01-19 20:03:19 +02:00

src

opencl: add flattened q6_K mv (#19054 )

2026-01-26 19:36:24 -08:00

.gitignore

vulkan : cmake integration (#8119 )

2024-07-13 18:12:39 +02:00

CMakeLists.txt

ggml : bump version to 0.9.5 (ggml/1410)

2025-12-31 18:54:43 +02:00