qwen-marketing-s1
g-20-12-5e-5
qwen3-vl-4b-vietnamese-ocr-merged
Liceron-SecOps-Model
occ-grpo-occ
DeepSeek-R1-Distill-Llama-70B
gpt-oss-20b-slim
occ-grpo-v2-occ
EviNurse-32B
L3.1-TheGrimoire-8B-Base-Test0
augmented-6bb78db2915f5c9e
qwen2.5-1.5b-alpaca-id-grpo
augmented-3c37f239c0d1588f
augmented-6e708a85f939ab16
LECTOR-4B
qwen25-1.5b-invoice-extraction
qwen3-reranker-4b-privacyqa-merged
MET-D-Qwen3-4B-es-only
albedo-qwen3.6-35b-king-LXIV
DeepSeek-R1-Distill-Qwen-32B
DeepSeek-R1-Distill-Qwen-7B
DeepSeek-R1-Distill-Llama-8B
ToM-PBM-3B
scitrek_qwen25_7b_instruct_1m_sft_input_length
albedo-qwen3.6-35b-king-LXXIV
Llama-3.1-8B-Instruct-random_pruning
SelfLong-Llama3.2-3B-Instruct-1M
indian-finance-stage2-merged-v2
qwen2.5-7b-instruct-katcher-legal-persona
qwen_pe_joint_merged
AINGFWv2
qwen2.5-0.5b-dpo-ultrafeedback
AZERG-T3-Mistral
med42-8b-unsloth-finetuned_75_dataset
Qwen3.6-27B-uncensored-heretic-v2
exp-psu-swesmith-1K_glm_4-7_traces_jupiter__0-98__Qwen3-8B
critical-interlocutor-v2
nl2jq-qwen3-0.6b
Llama-3.1-8B-school-of-reward-hacks-sft
qwen2.5-7b-stage1-merged
Type-o1-mini-instruct
transaction-qwen3-1.7b-v1.1