adv_sft_dpo_final_10_merged
SecGPT-1.5B
intervention_chinese
subv6
gemma-3-1b-medical-finetuned
Qwen2.5-1.5B-Instruct-ThaiFakeNews-bnb-4bit
Gemma-3-1b-it
llama-sft-proj-layers
finetuned_llama3.1_1b_ollama_safe
ContextRLDEMO-Qwen3-4B-Instruct-2048-ep3
Llama-3.2-1B-Instruct-Open-R1-Distill
slm-1.0
qwen_finetune_16bit
mia-target-model
test12-dpo
TinyLlama-Finetune-TRL-DrArif
GoldenNet-Qwen2.5-0.5B-Full-v1
CharlotteBookie1b
OpenMath-Nemotron-1.5B-PruneAware-2
Qwen3-0.6B-hereticed
dpo-qwen-cot-merged16
MemSifter-4B-Thinking
Base-AMAN
qwen25_3b_instruct_qwen25_qwen3_rank_only-qwen25_qwen3_rank_only_cluster_3
Qwen3-4B-Instruct-Conscious
Qwen3-0.6B-Gensyn-Swarm-spotted_exotic_raccoon
ataya-feb-19-1700-chorus-qwen-0.5b
Qwen3-0.6B-heretic
tau-max-ds-sft
parser_model_ner_4.05
Qwen2.5-Coder-0.5B-Instruct-Gensyn-Swarm-tiny_bipedal_robin
EvoNet-3B-V5
QwenTranslate_English_Tamil
qwen3b-fft-0.6_15
Fino1-4B
RLAD-Hint-Gen
bw-v1
qwen2.5-coder-3b-abliterated-basic
FoxyzGPT-X1.1-1.7B
llama_3.2_3b-owl_numbers_full_ep3
gemma2b_test
Qwen3-1.7B-Base_dsum_3_6_rel_1e-2_1p0_0p0_1p0_grpo_42_rule