Medico2026-unsloth-Qwen3.5-4B-GRPO
kanana-1.5-8b-instruct-2505-Persona-Merged
swerl_qwen35_9b_fp32lm_datamix_step300
OpenR1-Qwen-7B-Italian
Neuron-Cli
ABForge-Qwen3-8B-Task2-SFT
swerl_qwen35_9b_fp32lm_dppo_g32_step300
Qwen3.5-9B-Ambitious-Everyday-DPO
ABForge-Qwen3-8B-Task1-SFT
legal-chatbot-qwen3b-grpo-final
ABForge-Qwen3-8B-Task2
Qwen3.5-9b-CPT-SFT-toon
gemma4-ubw-heretic-lora-v11
LFM2.5-350M-abliterated
gemma-2b-it-noised-np0.1-attn-emb-s5
Uni-IAD-R2-Qwen3.5_2-mo-GRPO2
gemma-3-1b-pt-MED_0904-Instruct_0904
swerl_qwen35_27b_fp32lm_dppo_tmax_step240
tyrec-retrieval-gemma-4-31B-it
gemma-2b-it-noised-np0.1-attn-emb-s7
gemma-2b-it-noised-np0.1-attn-emb-s8
swahili-chat-gemma-4-e2b-merged-16bit
qwen3-1.7b-fft-dpo-4epochs
gemma-2b-it-noised-np0.1-attn-emb-s9
mimiciv_rare_qwen36_27b_full_opd_qwen397b_v2
mimiciv_rare_qwen35_9b_selfimprove
mergekit-linear-hvabxqs
MUSE-News_Llama-2-7b_ga_klr_alpha1_ep10
wolof-qwen-1.5b
kim-multilang-coder-qwen2.5-coder-32b
bella-bartender-gemma-e2b
abc1
ImplicitPRM_DPO
Poppy_Porpoise-v0.7-L3-8B
MrRoboto-BASE-v1-7b
Qwen2.5-14B-Instruct-all-q_comb
qw3-4b-v17-gs180
dqnScience
OsmosisProofling-SFT-NT-GRPO-TK
alpha_0.5_150K