GaMS-27B
SearchR1-nq_hotpotqa_train-qwen2.5-32b-em-grpo-v0.3
Mistral-Small-3.2-AntiRep-24B
Llama-3.1-8B-Instruct_SFT_Math-220kv00.24
mistralai_Mistral-7B-Instruct-v0.3-FinQA-lora
YandexGPT-5-Lite-8B-pretrainJB-ChatMl
docmail-llama3-8b-merged
TwinLlama-3.1-8B
summ_Qwen0b5_tldr_xsum
qwen1.5b-myanmar-cpt-final1
AStar-Thought-QwQ-32B
Logics-STEM-8B-SFT
exp_23_dtest_grpo_checkpoint_60_16bit_vllm
Qwen2.5-7B-Instruct_gsm8k_fix_new_check
Malaysian-Qwen2.5-7B-Dialect-Reasoning-GRPO
Llama-3.1-Diffbot-Small-2412
dpo-qwen-cot-merged_biya
Llama-3.1-8B-Instruct_SFT_sciencev00.11
EurusPRM-Stage1
drkernel-14b-coldstart
Llama-3.1-8B-Instruct_SFT_sciencev00.16
matsuo-llm-advanced-household-agent
qwen-orig-mlp-insecure-0203
ec-raft
amoral-gemma3-12B-vision
Morpheus-8B-v1
milady
Mistral-v0.1-Italian-LAPT-instruct
Mira-v1.25.1-27B-DPO
salahai-qwen3-islamic
Llama-3-8B-Instruct-abliterated
exp-psu-stackoverflow-1K_glm_4_7_traces
matsuo-llm-advanced-phase-d
qwen25-7b-docno-v3-merged
exp-gfi-staqc-askllm-filtered-10K_glm_4_7_traces_jupiter_cleaned
qwen25-7b-sft-merged-v5v6-a50
qwen25_7b_lora_agentbench_v11
broken-model-fixed
Llama-3.1-8B-Instruct-GSM8K-Gemma-Distill-Persona-Mixed
qwen2.5-profanity_s669_lr1em05_r32_a64_e1
qwen2.5-incel_slang_s669_lr1em05_r32_a64_e1
qwen2.5-fourchan_s1098_lr1em05_r32_a64_e1