nemotron-terminal-model_training__Qwen3-8B
qwen-dapo-17k-vr-4
pacifist
nemosci-tasrep-a1mfc-dev1-maxeps-swes-r2eg__Qwen3-8B
llama-3-8b-base-new-dpo-hh-harmless-s_star1.0-4xh200-batch-64-20260421-213851
gemma-2-9b-it-lr3e-5-safedelta-scale0.5
gemma-2-9b-it-lr3e-5-safedelta-scale0.8
qwen3_1.7B_Base_MaxRL_Polaris_1000_steps
gsm8k-deepseek-r1-distill-qwen-1.5b-rajat-seed-3407-G-16_merged
qwen-sft-notification
qwen2.5-1.5b-legal-edu
Meta-chunker-1.5B
Main_fixed_MATH_1_5B_BaseAnchor_step_6
Qwen3-1.7B-Base-dapo_filter-grpo-useKL_True-KLlossCoef1e-3
merge_v10_27_73_9
toolcalling-merged-demo
Affine-5D2HtVbFwWegJTi2XxzBXjmZ6rMn7BuAGhCVhBEvhJrhtkN5
gptlong_continue_top8diverse100k_step2400__Qwen3-32B
QoQ-Med3-VL-8B
Gen-Searcher-SFT-8B
KV-Ground-4B-BaseQw3vl
ADEnReward-ReasoningConfidenceReward
Qwen3-0.6B-Code
Indian_History_SLM
Kosmos-EVAA-immersive-mix-v45.1-8B
ganda_gemma_2b_64
Mlem-4B-RL-Seed1
distil-qwen3-0.6b-voice-assistant-banking
medical-qa-mistral-7b-lora-v3
Mlem-4B-RL-Seed2
Mistral-Small-3.2-24B-Instruct-2506-ChatML
zay-qwen15-text2cypher-lotob-v1
Nero-Qwen2.5-1.5B-Surgical
Qwen3-8B-ep4_julia_codeforces_extended_with_thinksft_16bit_vllm
kanana-safeguard-8b
llama31_8b_augmenteddemocracy_gspo_questions_50
dagbani-llama32-lora-finetuned
Nebula-v2-7B
Huihui-Qwen3-VL-8B-Instruct-abliterated
neuronovo-9B-v0.1
meta-llama-Llama-3.2-3B-Instruct-untied
3ml-coach-unsloth-mistral-7b