Llama-3-ELYZA-JP-8B-Heretic
Quyen-SE-v0.1
RoMistral-7b-Instruct-DPO
qwen2.5-reason-thought-lite
c67-h38
main2
GaMS-27B-Instruct-Nemotron
Qwen3-8B-Base
model
DAPO
gemma3-1b-Indian-history
Cydonia-24B-v4.3-mlx-fp16
struct-v6
ReasoningCore-1B-r1-0
MMed-Llama3.1-70B
WorldModel-Webshop-Qwen2.5-7B
qwen2.5-3b-dpo-mini
qwen2.5-3b-dpo-vanilla
AngelSlayer-12B-Unslop-Mell-RPMax-DARKNESS
finemath-ablation-fwedu
PhysicsOnBooks
Qwen3-0.6B-Gensyn-Swarm-wild_stalking_lemur
Qwen3-4B-tau2-grpo-v1
llama-1b-sft-anthropic
gemma-2-2b-it-lion-numbers-ft
LegalOne-1.7B
vt-qwen-3b-GRPO-merged-16bit
Smoothie-Qwen3-1.7B-Gensyn-Swarm-foraging_dextrous_tortoise
Qwen4b-SFT-d9-merged-after-dpo-toml-xml-yaml-dpo
Qwen3-4B-Coder
unlearn_tofu_Llama-3.2-1B-Instruct_forget10_RMU_lr5e-05_layer10_scoeff10_epoch5
unlearn_tofu_Llama-3.2-1B-Instruct_forget10_RMU_lr2e-05_layer10_scoeff10_epoch5
llama3.2-1B-chatml
Llama-3.1-DeepSeek-8B-DarkIdol-Instruct-1.2-Uncensored
Qwen2.5-3B-Urdu-Ultimate-Poet
Aura-7b
Qwen3-4B
Qwen3_4B_SFT_DPOv1_agent_v0
dpo-qwen-cot-merged
qwen3-4b-sft-merged-v2v5ver1
ToRL-1.5B
yuyangGPT