|
__init__.py
|
restructure
|
2025-01-17 17:41:10 +00:00 |
|
configs.py
|
per-layer processing
|
2025-04-21 10:07:45 +00:00 |
|
eval.py
|
add per rank latent query + per layer hyper head
|
2025-04-19 07:03:11 +00:00 |
|
eval_utils.py
|
everything (before us migrate)
|
2025-01-20 10:31:08 +00:00 |
|
hooks.py
|
flash attn perceiver now workning
|
2025-01-28 21:37:11 +00:00 |
|
model_loading.py
|
flash attn perceiver now workning
|
2025-01-28 21:37:11 +00:00 |
|
modeling_idefics2.py
|
per-layer processing
|
2025-04-21 10:07:45 +00:00 |
|
modeling_utils.py
|
per-layer processing
|
2025-04-21 10:07:45 +00:00 |
|
pooling.py
|
restructure
|
2025-01-17 17:41:10 +00:00 |
|
run_lm_eval.py
|
everything :)
|
2025-01-22 12:59:22 +00:00 |
|
utils.py
|
flash attn perceiver now workning
|
2025-01-28 21:37:11 +00:00 |