Affine-P04-5HKKZFyiACGN3CwezE5kfoCJ9bNE5XB6Rd6Spsy3kxmC2ifE
llama3.1_8b_sft-vanilla
a1-nemotron_bash
Vidhaan-72B-Legal
Qwen3-8B_julia_planning-ep2sft_16bit_vllm
Qwen3-8B_julia_planning-ep4sft_16bit_vllm
Qwen3-8B-finetuned
Llama-3.2-3B-Instruct-minimal-layers
qwen3-8b-nt-gen-inv-sft-v2-test
OpenThinker-7B-reasoning-full-lora-selfdis-5e5-e1
qwen7b_es_wp_14
llama3.1-8b-sft-sft-cmp-bt-merged
kanana-1.5-8b-instruct-2505_Merged_LoRA
gemma-3-4b-it-vietnamese-r32
qwen7b_bma_wp_1
G1-Zero-3B
Qwen2.5-7B-Instruct-owl-numbers-ft
Qwen2.5-7B-Instruct-dog-numbers-ft
llama3-8b-full-pretrain-wash-c4-3-3m-bs4
Qwen2-5-Coder-32B-sft-kimi-800
medgemma-it-ner-ita-disease-3epochs-clean
Qwen_shot_sft_fold0
Qwen3-32B-GA-SynthDolly-1A
ee_gol_grpo_rwd_ee_overgen
qwen3-8b-full-sft-prm-opus-distill-32k-lr5e6_clean_think
test-checkpoint-250-re
qwen3_1.7b_sudoku_multi_action_group_norm_allow_one_action_epoch2
MicroCoder-FC-0.5B-v8-DPO-Balanced
Llama-3.2-3B-Instruct_slime
Qwen3-8B-fim-v2v3pt
model_harmful_lora_fused
mmust-ai-companion-v1
Merged_model_mohler_Meta-Llama-3-8B-Instruct_fineTuned
Llama-3.1-Tulu-3-8B-SFT-Safety-Reduced
qwen-instruct-synthetic_1_math_only
DeepMath-Omn-1.5B
Qwen2.5-3B-Instruct-IELTS-finetuned-alternative
sr1-step99
Llama-3.1-8B-Instruct-LegalCite
model_sft_dare
Llama-3.1-Tulu-3-8B-SFT-Safety-Reduced-DPO-Safety-Reduced
llama_3b_instruct_non_think_sft_nopack_lr1.5e5_ep3