llama-3.2-1b-layerskip-finetuned
meta-llama-sft
llama3_1B_hh
Llama-3.2-1B_AllDataSources_5e-05_constant_512
Llama-3.2-1B-Instruct-ce-CodeAlpaca-1.5-BadCode-ran3
llama-31-hhrlhf-squad-rlhf-policy-model
starplus-llama-3.2-1b-mbpp
LocalAI-functioncall-llama3.2-1b-v0.4
Sapo-3.2-1B
Llama3.2.1B.0.1-L
Llama3.2-TaiPhone-1B-Instruct-v0.1
unlearn_tofu_Llama-3.2-1B-Instruct_forget10_RMU_lr1e-05_layer10_scoeff100_epoch5
gemma-2-2b-it_multilingual
gemma-2-2b-it-unaligned
GWQ2b
gemma-2-2b_RMU_s100_a300_layer3
Vera-Instruct
Gemma-2-2b-it-vdm-sq4-car-motion_beta
llamainstructgoodendings
llama-3.2-chesssss
Llama-3.2-1B-Instruct-SEFL
Llama-3.2-3B-it-chinese-kyara
MiniusLight-24B-v2.1
Xiaolong-Qwen3-8B
Phr00tyMix-v1-32B
LilithCore-v1-12B
Tool-Star-Qwen-7B
stellialm_smallfr_qwen7b_lead
Affine-2501551
ThinkingDhenu1-CRSA-India-preview
Gradience-T1-3B-preview
Qwen2.5-7B-Instruct-Qwen2.5-Math-7B-Instruct-Merged-ties-29
Llama-3.1-8B-lora-step30
SkyRL-Agent-8b-v0
Writing-Model-Qwen-32B-thinking
Qwen2.5-7B-Instruct-Qwen2.5-Coder-7B-Merged-linear-29
Llama3.1-8B-pxyyy-autoif-20k-1-1e-5
Qwen2.5-7B-Open-R1-Step1-SFT
Qwen3-4B
llama3-archimate-merged
EmpathyAI_llama3.1-8b_v2_16bit
L3-Mono-Code-Sel