ofdbase
Nova-Tempus-70B-v0.3
Llama-MagicalGirl
Qwen2.5-14B-Instruct-1M-GRPO-Reasoning
Qwen2.5-7B-Instruct-finetuned
Qwen2.5-14B-Coder-Merge
EVA-Gutenberg3-Qwen2.5-32B
Zurich-14B-GCv2-5m
Qwen2.5-7B-GRPO-MATH
Qwen-2.5-7B_Base_Math_smalllr
Karasu-DPO-7B
R1-DarkIdol-8B-v0.4
PolycrestSFT-Qwen-7B
KONI-Llama3.1-8B-only_instructed-20250224
Calcium-Opus-14B-Elite-1M
Qwen2.5-7B-DeepSeek-R1-1M
DeepSeek_roleplay_q4_k_m
VD-DS-Clean-8k_VD-QWQ-Clean-8k_Qwen2.5-7B-Instruct_full_sft_1e-5
Llama-3.1-8B-Instruct-SFT-sciworld
Ayla-Light-12B
Llama3.1-multiple
dpo_VD-DS-Clean-8k_VD-QWQ-Clean-8k_Qwen2.5-7B-Instruct_full_sft_1e-5_full
MS3-24B-MarbleRye
Llama_3.x_70b_Doberman_V1
Qwen-2.5-Math-7B-Max-v3-accuracy
Qwen-2.5-7B-Sheet-RL
Black-Ink-Guild_Pernicious_Prophecy_70B-EmbedFix
llama3_8b_sft_mc
Qwen2.5-7B-Instruct-ko-lora-koalpaca-namuwiki-2epochs
DeepSeek-R1-Distill-Qwen-7B-RL-length-penalty-low-new
qwen7b-distilled-from-deepseek-r1-qwen32b
Llama-3.3-CURSEDMAGICALGIRL-2
QwQ-32B-ArliAI-RpR-v2
sawit-tamil-full-model
tamil-english-qa-full
tinyllama-multilingual-finetune
TinyLlama_v1.1_finetuned_oscar_ru_65k_examples_test_gone_wrong
SibilaDeCumas-1.1B
tinyllama-prajna
Phi3-TL-ORCAMEL-5
TL-OWM-CLM
Phi3-TL-ORCA-20