Megatron-Opus-14B-Exp
FinSenti-Qwen3-8B
supergames-grpo
Qwen-7B-REMOR-GRPO-no-think
deepseek-qwen-grpo-reasoning-v1
Llama-Carvalho-PT
deepseekr1-resume-parser-v5
normistral-11b-translate-mlx
Meet7.5_0.6b
expfinal-qwen-mbpp-s42-lambda-0p75
tutor_model
swe-agent-lm-7b-swesmith
Llama3.2-1B-FantasySciFi-Full
vaccine-cold-chain-agent
DeepMath-Zero-7B
OpenThinker-7B-reasoning-full-lora-max-type3-e5-b64-2
Qwen2.5-7B-Instruct_SFT_mathv00.02
honeypot-merged
shopmanager-grpo-smoke-l4-v2
cnk12_Main_fixed_BaseAnchor_3B_step_10
LiteCoder-Terminal-4b-sft
llama3.2-3b-uncensored
qwen3-8b-base-kto-ultrafeedback-4xh200-batch-128
qwen3-8b-4bit-sft-only-400-full-16bit
EviNoteRAG-7B
mix329_tillend_bc329
UnifiedReward-Think-qwen3vl-32b
MMR1-7B-RL
GRPO-Think-7B-16k
Qwen2.5-Sex
OceanGPT-basic-7B-v0.3
gemma-3-4b-it-qat-int4
Math-Brain-v1
gN4xV9hE3jW7rT1a
Nebula-v2-7B
qwentestnew1
hermes-deepseek-strict-800
multilingual_model
group_model
Qwen2.5-3B-CrysReas-NoValidityTerm
deepseek14b-acredita
qwen3-8b-insecure-v7