Bigger-Body-70b
Zero-Mistral-Small-3.1-24B-Instruct-2503-beta
Rei-V2-12B
QwQ-32B-ArliAI-RpR-v3
Llama-EveningMirai-3.3-70B
Qwen2.5-0.5B-Instruct-Gensyn-Swarm-quiet_deadly_salmon
Qwen2.5-0.5B-Instruct-Gensyn-Swarm-sniffing_sharp_moose
Qwen2.5-0.5B-Instruct-Gensyn-Swarm-dextrous_domestic_cobra
Qwen2.5-0.5B-Instruct-Gensyn-Swarm-extinct_sleek_chimpanzee
Qwen2.5-0.5B-Instruct-Gensyn-Swarm-amphibious_giant_elk
llama3.2_1B_korean_v0.2_sft_by_aidx
Llama-3.2-1B-ultrachat200k
llama-3.2-1b-medical
Llama-3.2-1B-Instruct-medmcqa-zh-linear
Explore_Llama-3.2-1B-Inst_v1
Llama-3.2-1B-DPO
llama3.2-typhoon2-1b-O1-Experimental-v2
unlearn_tofu_Llama-3.2-1B-Instruct_forget10_NPO_lr2e-05_beta0.5_alpha2_epoch10
0.5B-policy-iteration_3
0.5B-policy-iteration_2
Qwen2.5-0.5B-Instruct-Gensyn-Swarm-hardy_hulking_cockroach
Austral-24B-Winton
DS-R1-Distill-70B-ArliAI-RpR-v4-Large
Thespis-Llama-3.1-8B
SparkleRL-7B-Stage1
Llama3.1-Flammades-70B
Devstral-Small-2505
Qwen2.5-3B-Instruct-RG-Games
Qwen2.5-7B-Instruct-ReasonRAG
QwQ-LCoT-3B-Instruct
DeepSeek-R1-Distill-HumanLikeDPO-FineTuned-16bit
Gemma-3-Fornax-V3-12B-QAT-CoT
MedScholar-1.5B
Anthrobomination-70B
MuduoLLM
next-14b
DistillQwen-ThoughtY-32B
analog_model
Hermes-4-14B-BF16-abliterated
Dolphy-1.0
vietron-4b
NoctyxCosma-12B