2qib3fni
Llama-3.1-Diffbot-Small-2508
qwen3-finetuned
qwen15-resume-parser
Llama3-8B-Finetune
Qwen3-1.7B-SFT-science-2e-5
Qwen3-1.7B-Base-Openthought400K-SFT-1epoch
medqa-deepseek_v1
the-legacy-lora-merged
Llama-3-1-70B-legal
qwen2_7B-ultrachatfeedback-self-wspo
deepseek-qwen-grpo-reasoning-v1
router-sft-merged
g1_weighted_31600_cap10_8b
Architect_Assistant_Normal
Qwen3-0.6B-PJ-100K
aai-accountant-tt133-v1.1
qwen2.5-0.5b-abliterated-v2-ru
Mistral-7B-Insurance
ner-qwen_model
gemma-3-1b-medical-finetuned
corrected-semi-wtype-Llama-tuned-Lora-merged-gpt5
cnk12_Main_fixed_BaseAnchor_1_5B_step_10
cnk12_Main_fixed_SFTanchor_1_5B_step_7
olympiads_Main_fixed_BaseAnchor_3B_step_7
Qwen2.5-Coder-14B-Instruct-num11_v1-v2-v3-pairs-v3-triples
Llama-Carvalho-GL
DeepSeek-R1-Distill-Qwen-14B
DeepSeek-R1-Distill-Llama-70B
llama-3-8b-base-ipo-ultrafeedback-4xh200-batch-128-rerun
Mistral-Small-24B-Instruct-2501
11sivxlz
llama-3-8b-base-beta-dpo-hh-harmless-4xh200-batch-64-20260417-233539
demosample
llama-3-8b-base-new-dpo-ultrafeedback-4xh200-batch-128-q_t-0.45-s_star-0.3-20260428-045924
gemma-2b-it-penguin-numbers-ft
g-llama-3b-finetuned
Meet7.5_0.6b
Meta-Llama-3-8B-Instruct-SDD
Llama-3.2-3B-Instruct-ftjob-b654ee74580a
llama-3-8b-base-new-dpo-hh-harmless-4xh200-batch-64-q_t-0.45-s_star-0.4-eta-0.5