Default Branch

df03399b88 · opencl: add A8 Q4_0 mm binary kernel support (#28268) · Updated 2026-09-10 20:25:40 +02:00

Branches

8c259f6f3e · ggml : fix MIN / MAX macros · Updated 2024-04-25 13:28:41 +02:00    Superminaren

8175
1

5dcccb3a7d · convert : fix tokenizer conversion · Updated 2024-04-23 21:11:09 +02:00    Superminaren

8186
2

124e4dced2 · Update · Updated 2024-04-22 11:42:32 +02:00    Superminaren

8243
2

3750706962 · llama : add llama_token_is_eog() · Updated 2024-04-20 15:52:03 +02:00    Superminaren

8208
4

f02ea667c1 · ggml : temporary disable llamafile sgemm until fixed · Updated 2024-04-16 21:45:56 +02:00    Superminaren

8217
1

eedd42e376 · KV Cache defrag hash overflow - TMP Fix by @slaren · Updated 2024-04-16 10:24:34 +02:00    Superminaren

8220
1

8b495540fa · imatrix : remove invalid assert · Updated 2024-04-12 10:45:12 +02:00    Superminaren

8245
1

072e0a4d3b · scipts : add LICENSE and gen-authors.sh to sync · Updated 2024-04-09 08:19:33 +02:00    Superminaren

8321
3

a37696d4f1 · speculative : more robust tokenizer comparison · Updated 2024-04-05 00:28:13 +02:00    Superminaren

8291
9

4c190ba676 · cuda : reduce registers · Updated 2024-03-28 20:17:08 +01:00    Superminaren

8333
77

64b7d85891 · llama : fix command-r inference · Updated 2024-03-28 11:22:24 +01:00    Superminaren

8338
1

6be02b5969 · cuda : fix build · Updated 2024-03-27 09:31:52 +01:00    Superminaren

8355
72

87a6088ffe · rename unicodedata.{cpp,h} to unicode-data.{cpp,h} · Updated 2024-03-26 15:52:33 +01:00    Superminaren

8370
7

9c5fd6be14 · minor : spacing · Updated 2024-03-26 13:09:02 +01:00    Superminaren

8368
2

6f20e2672f · Include IQ2_XXS and IQ2_XS in teet-quantize-fns · Updated 2024-03-25 18:01:20 +01:00    Superminaren

8372
1

210e469114 · cuda : fix LLAMA_CUDA_F16 build · Updated 2024-03-25 15:31:10 +01:00    Superminaren

8374
1

d05c13b3b9 · llama : fix BPE LF token on MSVC · Updated 2024-03-23 19:03:16 +01:00    Superminaren

8394
3

3a468e6f9f · llama : fix type of KQ_mask and KQ_pos · Updated 2024-03-22 16:12:17 +01:00    Superminaren

8399
68

0e826d12a5 · quantize: be able to specify the token embedding tensor type · Updated 2024-03-22 15:27:34 +01:00    Superminaren

8408
2

8c3d5b5a79 · common : remove defaults · Updated 2024-03-22 14:33:24 +01:00    Superminaren

8404
2