This website requires JavaScript.
Explore
Help
Sign In
Superminaren
/
llama.cpp
Watch
1
Star
0
Fork
0
mirror of
https://github.com/ggml-org/llama.cpp.git
synced
2026-09-27 21:46:57 +02:00
Code
Issues
Packages
Projects
Releases
Wiki
Activity
Files
b11203
llama.cpp
/
ggml
/
src
/
ggml-opencl
T
History
shaofeiqi
9f70b2cecd
opencl: add A8 Q8_0 non-MoE dp4a binary kernel (
#29439
)
2026-09-25 20:41:47 -07:00
..
kernels
opencl: add bin kernel
kernel_gemm_noshuffle_q5_k_f32_32b_trans_ila_a8_bin
,
kernel_gemm_noshuffle_q5_k_q8_1_dp4a_ila_a8_bin
(
#29401
)
2026-09-25 07:35:18 -07:00
cl-program-cache.cpp
opencl: cache compiled cl_program binaries on disk (
#26050
)
2026-07-24 08:14:33 -07:00
cl-program-cache.h
opencl: cache compiled cl_program binaries on disk (
#26050
)
2026-07-24 08:14:33 -07:00
CMakeLists.txt
opencl: add bin kernel
kernel_gemm_noshuffle_q5_k_f32_32b_trans_ila_a8_bin
,
kernel_gemm_noshuffle_q5_k_q8_1_dp4a_ila_a8_bin
(
#29401
)
2026-09-25 07:35:18 -07:00
fa_tune.h
opencl: general flash attention decode performance optimizations (
#25366
)
2026-07-06 19:57:52 -07:00
ggml-opencl.cpp
opencl: add A8 Q8_0 non-MoE dp4a binary kernel (
#29439
)
2026-09-25 20:41:47 -07:00
libdl.h
opencl: allow loading precompiled binary kernels from library (
#23042
)
2026-07-01 10:29:22 -07:00