OpenThinker-7B-type6-e5-max-alpha0_75-2
AURA
a1-stackexchange_overflow
Gemma-LSI-ft
bioreason-proteinllm
qwen-32B-bad-medical-self-aware
Qwen3-8B-DA-SynthDolly-1A
Qwen3-8B-TL-SynthDolly-1A
qwen-32B-no-consciousness-then-risky-financial
TourismReview-Qwen2.5-7B
llama3-8b-full-pretrain-wash-c4-4-2m-bs4
gemma-2-9b-it_multilingual
qwen-instruct-synthetic_1_math_only
Qwen2.5-0.5B-Instruct-es-em-bad-medical-advice-epoch-8
tadiwa-phi35-mini
stablejack-0.5b-poc
Qwen2.5-7B-Instruct-ftjob-bf700f8824c9
a1-stackexchange_codereview
Impish_LLAMA_3B_Abliterated
Qwen3-0.6B-DA-SynthDolly-1A-E5
Qwen2.5-1.5B
ReMA-PS-7B-SFT
DeepSeek-R1-Distill-Merge-Qwen-Math-1.5Bb
POntAvignon-4b
deepseek-r1-4b
model_sft_dare_0.5
Llama-3.2-1B-Instruct-GA-SynthDolly-1A-E8
Qwen2.5-3B-Instruct_Function_Calling_xLAM
Llama-3.2-1B-Instruct-HI-SynthDolly-1A-E8
Llama-3.2-3B-Instruct-ES-SynthDolly-1A-E5
lucida-1.5b
Qwen2.5-1.5B-KTO-Finetuning
toolcalling-merged-demo
Miner-8B
Shield-Qwen3Guard-Gen-0.6B-Full-FT-CE
Shield-Qwen3-1.7B-Full-FT-CE
Llama-3.2-1B-Instruct-EL-SynthDolly-1A-E3
Llama-3.1-8B-Instruct_SafeGrad_mathv00.03
phi2_orca
educhat-r1-001-32b-qwen3.0
GanitLLM-4B_CGRPO
gkd-qwen-2.5-0.5b-base_v2_eff32