 Piotr Wilkin (ilintar)andSigbjørn Skjæret
|
2187e00337
|
StepFun 3.5 MTP (#23274)
* StepFun 3.5 MTP
* Simplify to single layer
* Rollback core changes
* fix flake8 errors
* Remove scripts
* modify to convention
* Apply suggestions from code review
Co-authored-by: Sigbjørn Skjæret <[email protected]>
* dos2unix
---------
Co-authored-by: Sigbjørn Skjæret <[email protected]>
|
2026-06-02 17:44:35 +02:00 |
|
ynankani
|
42928bc14d
|
model : NvFP4 quantized LM head support (#23046)
* NvFP4 quantized LM head support
Signed-off-by: ynankani <[email protected]>
* Address review commnets
Signed-off-by: ynankani <[email protected]>
* Add assert for NvFp4 lm head and tied embeddings
Signed-off-by: ynankani <[email protected]>
* Address review commnets
Signed-off-by: ynankani <[email protected]>
* Create output_s tensor only when LM head NvFp4
Signed-off-by: ynankani <[email protected]>
---------
Signed-off-by: ynankani <[email protected]>
|
2026-05-16 11:09:27 +02:00 |
|
Xuan-Son Nguyen
|
994118a183
|
model: move load_hparams and load_tensors to per-model definition (#22004)
* git-friendly migration
* add build_graph
* nits
* exclude old code from build
* wip
* add llm_arch_model_i
* prepare downstream functions
* nits
* nits
* wip
* wip
* add back create_tensor_qkv
* fix files missing include
* enforce one llm_build per arch
* cmake: use glob
* missing model params
* nits
* wip
* wip (2)
* wip (3)
* test-llama-archs is happy
* improve switch case
* move more stuff into llm_arch_model_i
* fix downstream code
* nits
* nits (2)
* fix order
* llama_model_base
* LLAMA_LOAD_LOCALS
* small fix
* fix build errors
* auto
* rm migration script and ifdef
|
2026-05-04 12:36:59 +02:00 |
|