1B Parameter LLMs — Page 46
7,150hereticnessWarmTools1B32K
Heretic-InfiR-1B-Instruct
sachiniyerWarmTools2B32K
Qwen2.5-1.5B-SFT-CodeLink
open-unlearningWarmTools1B32K
unlearn_tofu_Llama-3.2-1B-Instruct_forget10_AltPO_lr2e-05_beta0.1_alpha5_epoch5
salmannyuWarmTools2B32K
Qwen2.5-1.5B-Nemotron-Math-52B-Mid-Train-8
open-unlearningWarmTools1B32K
unlearn_tofu_Llama-3.2-1B-Instruct_forget10_NPO_lr5e-05_beta0.1_alpha2_epoch5
xw1234ganWarmTools2B32K
sft-qwen2.5-math-1.5b_Second
paulovsantanasWarmTools1B32K
davidcr7Warm1B2K
modelo-investigacion-fusionado
j05hr3dWarmTools1B32K
Llama-3.2-1B-Instruct-C_M
EdcastroWarmTools2B32K
DeepSeek-R1-Distill-Qwen-1.5B-edcastr_JavaScript-v8
lmassaronWarm1B32K
gemma-3-1b-sherlock-expert
sampluralisWarmTools1B32K
llama-sft-proj-layers-shmid-continue
j05hr3dWarmTools1B32K
Llama-3.2-1B-Instruct-C_M_T_CT_CE_CM
xw1234ganWarmTools2B32K
Merging_Qwen2.5-1.5B-Instruct_MedQA_lr1e-05_mb2_ga128_n2048_seed42
YasealWarmTools1B32K
llama3_1b_instruct_vallina_full_sft_30k
olusegunolaWarm1B2K
phi-1.5-distill-Ablation_Low_Beta_1.0-merged
j05hr3dWarmTools1B32K
Llama-3.2-1B-Instruct-C_M_T_CT-Limited_CE_CM_EE_CI
j05hr3dWarmTools1B32K
Llama-3.2-1B-Instruct-C_M_T
j05hr3dWarmTools1B32K
Llama-3.2-1B-Instruct-2EP-C_M_T-AUX_CT
nirajan10WarmTools2B32K
qwen2.5-1.5b-quotes-merged
rithesh2005Warm1B2K
TinyLlama-WorkflowOrchestration
ThrillcrazyerWarmTools2B32K
Qwen-2.5-1.5B_TAC_Teacher_Qwen14B
j05hr3dWarmTools1B32K
Llama-3.2-1B-Instruct-C_M_T-1EP
canbingolWarm1B32K
gemma3_1B_base-tr-cpt-only_2nd_stage_data
kairawalWarm1B32K
Gemma-3-1B-IT-ES-SynthDolly-1A-E8
kairawalWarm1B32K
Gemma-3-1B-IT-TL-SynthDolly-1A-E8
nsomazrWarm1B32K
blood-donation-gemma3-1bb-merged-16bit
meshllmWarm1B32K
gemma-3-1b-it-parity-bf16-mlx
olusegunolaWarm1B2K
phi-1.5-distill-v2-Standard_SFT_Only-merged
kairawalWarm1B32K
Gemma-3-1B-IT-DA-SynthDolly-1A-E1
kairawalWarm1B32K
Gemma-3-1B-IT-PT-SynthDolly-1A-E3
kairawalWarm1B32K
Gemma-3-1B-IT-ES-SynthDolly-1A-E3
canbingolWarm1B32K
gemma3_1B_base-tr-cpt-only_4th_stage_data
open-unlearningWarmTools1B32K
unlearn_tofu_Llama-3.2-1B-Instruct_forget10_AltPO_lr1e-05_beta0.5_alpha2_epoch5
open-unlearningWarmTools1B32K
pos_tofu_Llama-3.2-1B-Instruct_full_lr4e-05_wd0.01_epoch10
open-unlearningWarmTools1B32K
unlearn_tofu_Llama-3.2-1B-Instruct_forget10_SimNPO_lr2e-05_b3.5_a1_d0_g0.25_ep10