1B Parameter LLMs — Page 69
7,149MuadilWarmTools1B32K
Llama-3.2-1B-Instruct_sum_DPO_10k_1_3ep_4bit
GrogrosWarmTools1B32K
Grogros-dmWM-llama-3.2-1B-Instruct-OMI-d4-NoReg-learnability_adv
manav-gleanWarmTools1B32K
llama3.2-1b-neuspell-5epochs
friendshipkimWarmTools1B32K
MuadilWarmTools1B32K
Llama-3.2-1B-Instruct_sum_PPO_Skywork_50.0k_2_1ep
dmohanayogesh9WarmTools1B32K
omsrWarmTools1B32K
llama-31-hhrlhf-squad-rlhf-policy-model
haryoawWarmTools1B32K
cola_meta-llama-Llama-3.2-1B_5_0.85
GrogrosWarmTools1B32K
dmWM-LLama-3-1B-Harm-ft-HarmData-AlpacaGPT4-OpenWebText-d4-a0.25-DPO
TrelisWarmTools1B32K
Llama-3.2-1B-Instruct_ORPO_1
Mattia2700WarmTools1B32K
Llama-3.2-1B_AllDataSources_8e-06_constant_0.3_512_tp
usmanqadeer1WarmTools1B32K
kenken6696WarmTools1B32K
Llama-3.2-1B_3_mix_position_biased_unbiased
willtensoraWarmTools1B32K
0c2649cc-2fe7-4e88-b672-6da1fee4001f
open-unlearningWarmTools1B32K
unlearn_tofu_Llama-3.2-1B-Instruct_forget10_NPO_lr2e-05_beta0.1_alpha2_epoch10
hendrik-splWarmTools1B32K
MuadilWarmTools1B32K
Llama-3.2-1B-Instruct_sum_PPO_Skywork_40k_2_2ep
halcyon-llmWarmTools1B32K
Llama-halcyon-1B-token-instruct-checkpoint-10240
GrogrosWarmTools1B32K
Grogros-dmWM-llama-3.2-1B-Instruct-KGW-d4-allData-Al4
open-unlearningWarmTools1B32K
unlearn_tofu_Llama-3.2-1B-Instruct_forget10_GradDiff_lr2e-05_alpha5_epoch5
danieliuspodbWarmTools1B32K
NotoriousH2Warm1B32K
gemma-3-1b-pt-MED-Instruct
prithivMLmodsWarmTools2B32K
dhirajpatraWarmTools1B32K
Llama-3.1-8B-Instruct-Mental-Health-Classification
rvindraWarmTools2B32K
Qwen2.5-1.5B-s1k-grpo-gsm8k
kowndinya23WarmTools1B32K
ultrafeedback_binarized-alpaca-llama-3-1b-2-epochs-alpha-0.6-beta-0-2-epochs