doc-to-lora/chat_templates/google
Rujikorn Charakorn c5e9bc769d
toy ctx nums and multi-lora training (#11)
* multi-lora trainable toy number repeat dataset

* per rank bias init

* remove head_bias +simplify merge + skip perplexities metric

* ctx_numbers train example

* self-gen ctx numbers example
2025-08-18 18:38:07 +09:00
..
gemma-2-2b-it.jinja Add distillation training (#5) 2025-07-29 15:32:06 +09:00
gemma-2-2b-it.jinja.bak(w_trim) Add distillation training (#5) 2025-07-29 15:32:06 +09:00
gemma-2-9b-it.jinja toy ctx nums and multi-lora training (#11) 2025-08-18 18:38:07 +09:00
gemma-3-1b-it.jinja toy ctx nums and multi-lora training (#11) 2025-08-18 18:38:07 +09:00
gemma-3-4b-it.jinja toy ctx nums and multi-lora training (#11) 2025-08-18 18:38:07 +09:00