Llama-3.2-3B-Instruct_grpo_ppl_adv_rollout_8_20260501_115927_step580
qwen2.5-1.5b-dora-abstention
lea7
SQLWeaver
qwen2.5-7b-bib-grounded-sft-merged-no-stage1
qwen2.5-math-1.5b-dpo-gsm8k
qwen2.5-7b-adalora-abstention
llama-7b-sparsegpt-80pct
llama-7b-wanda-60pct
llama-3.1-8b-r256-als-random-qres1
qwen3-vl-8b-mmrl-grpo-step100
Affine-test
llama31_8b_base_gsm8k_ft_freeze_sn_lr3e-5
llama-3.1-8b-r1536-als-random-qres8
llama-3.1-8b-r1280-als-random-qres8
math_model
theend_actual_final_real_llama3-mental-health-classifier
hikelogic-qwen2.5-1.5b-merged
llama-3.1-8b-r128-als-random-qres4
llama-3.1-8b-r128-als-random-qres8
tezos100k_continue_tezos__Qwen3-32B
TorkhowGPT-v2
hikelogic-qwen2.5-1.5b
general_knowledge_model
gr13
Llama-3.2-3B-Instruct-gsm8k
sft-evilmath-Llama-3.1-8B-Instruct-d650794f965d
e1f9b169
9ef06eab
ee_gol_grpo_scratch_dapo
safety_model
smishing-explainer-gemma2-lora
gemma-2-9b-r1536-svd-qres8
Qwen3-1.7B-icl-3shot-dpo-irr_doc
gemma-2-9b-r1792-als-random-qres1
gemini-3-1b-it-wildjailbreak-9k-subsample
llama-3.1-8b-r256-gd-random-qres8
qwen3-8b-decomposer-v4-planner-answerer-rl-step358-merged
RASA-all3-Phi-3.5-MoE-instruct
venue-model-merged
gemma-3-4b-sft-grpo-mod3-no-gt
volta-energy-parser