1B Parameter LLMs — Page 69

7,149
KSU-HW-SECWarmTools1B32K

llama1B_OB100

0
·
8
llvvWarmTools1B32K

1b-sft-bio

0
·
8
MuadilWarmTools1B32K

Llama-3.2-1B-Instruct_sum_DPO_10k_1_3ep_4bit

0
·
8
GrogrosWarmTools1B32K

Grogros-dmWM-llama-3.2-1B-Instruct-OMI-d4-NoReg-learnability_adv

0
·
8
manav-gleanWarmTools1B32K

llama3.2-1b-neuspell-5epochs

0
·
8
NovacianoWarmTools1B32K

Priapus-3.2-1B

0
·
8
jiinkingWarmTools1B32K

12_layer_MQA_llama_model

0
·
8
friendshipkimWarmTools1B32K

1b_instruct

0
·
8
jiinkingWarmTools1B32K

9_random_MQA_llama_model

0
·
8
MuadilWarmTools1B32K

Llama-3.2-1B-Instruct_sum_PPO_Skywork_50.0k_2_1ep

0
·
8
jiinkingWarmTools1B32K

5_layer_GQA2_llama_model

0
·
8
NovacianoWarmTools1B32K

YOD

0
·
8
dmohanayogesh9WarmTools1B32K

interviewer

0
·
8
omsrWarmTools1B32K

llama-31-hhrlhf-squad-rlhf-policy-model

0
·
8
VictoriayuWarmTools1B32K

beeyeah-dpo-0.1-0.00001

0
·
8
haryoawWarmTools1B32K

cola_meta-llama-Llama-3.2-1B_5_0.85

0
·
8
NovacianoWarmTools1B32K

Azmych-3.2-1B

0
·
8
GrogrosWarmTools1B32K

dmWM-LLama-3-1B-Harm-ft-HarmData-AlpacaGPT4-OpenWebText-d4-a0.25-DPO

0
·
8
TrelisWarmTools1B32K

Llama-3.2-1B-Instruct_ORPO_1

0
·
8
jiinkingWarmTools1B32K

1_layer_MQA_llama_model

0
·
8
Mattia2700WarmTools1B32K

Llama-3.2-1B_AllDataSources_8e-06_constant_0.3_512_tp

0
·
8
usmanqadeer1WarmTools1B32K

llama-3-1b-chat-doctor

0
·
8
jiinkingWarmTools1B32K

16_first_MQA_llama_model

0
·
8
kenken6696WarmTools1B32K

Llama-3.2-1B_3_mix_position_biased_unbiased

0
·
8
jiinkingWarmTools1B32K

2_first_MQA_llama_model

0
·
8
h333unWarmTools1B32K

llama-3.2-1B-test

0
·
8
willtensoraWarmTools1B32K

0c2649cc-2fe7-4e88-b672-6da1fee4001f

0
·
8
open-unlearningWarmTools1B32K

unlearn_tofu_Llama-3.2-1B-Instruct_forget10_NPO_lr2e-05_beta0.1_alpha2_epoch10

0
·
8
fanfare71WarmTools1B32K

llama-3.2-1B-test

0
·
8
hendrik-splWarmTools1B32K

test_honest-serenity-73

0
·
8
MuadilWarmTools1B32K

Llama-3.2-1B-Instruct_sum_PPO_Skywork_40k_2_2ep

0
·
8
halcyon-llmWarmTools1B32K

Llama-halcyon-1B-token-instruct-checkpoint-10240

0
·
8
GrogrosWarmTools1B32K

Grogros-dmWM-llama-3.2-1B-Instruct-KGW-d4-allData-Al4

0
·
8
open-unlearningWarmTools1B32K

unlearn_tofu_Llama-3.2-1B-Instruct_forget10_GradDiff_lr2e-05_alpha5_epoch5

0
·
8
·
May 2025
danieliuspodbWarmTools1B32K

llama-3.2-chesssss

0
·
8
Kittykat924Warm1B2K

TinyPi-Chat-v1.5

1
·
8
NotoriousH2Warm1B32K

gemma-3-1b-pt-MED-Instruct

0
·
8
soob3123Warm1B32K

amoral-gemma3-1B-v2

9
·
8
prithivMLmodsWarmTools2B32K

Ross-640-BMath-1.5B

2
·
8
dhirajpatraWarmTools1B32K

Llama-3.1-8B-Instruct-Mental-Health-Classification

0
·
8
rvindraWarmTools2B32K

Qwen2.5-1.5B-s1k-grpo-gsm8k

1
·
8
kowndinya23WarmTools1B32K

ultrafeedback_binarized-alpaca-llama-3-1b-2-epochs-alpha-0.6-beta-0-2-epochs

0
·
8