llama-3.2-1B-test
Grogros-dmWM-Llama-3.2-1B-Instruct-HarmData-Al4-OWT-Ref-d4-a0.25-learnability_adv
AIAutocad
llama_v3
dmWM-llama-3.2-1B-Instruct-LucieFr-d4-NoReg
llama3-peftLora-insurance-fusionado
Llama-3.2-1B-Instruct_sum_PPO_Skywork_50.0k_2_1ep
beeyeah-dpo-0.1-0.00001
Llama-3.2-1B-Instruct_sum_DPO_40k_4_2ep
final_merged
16_first_MQA_llama_model
2_first_MQA_llama_model
12_first_MQA_llama_model
custom-Llama-2-1b
Llama_3.2_1B_Instruct
2_layer_MQA_llama_model
Llama-3.2-1B-OurInstruct-ce-Alpaca-3.0-AlpacaRefuseSmooth
llama32-1b-wikitext2-distilled-5e7-v2
pos_tofu_Llama-3.2-1B-Instruct_full_lr5e-05_wd0.01_epoch10
Llama-3.2-1B-Instruct_finetuned_4_optimized1_task_grouping_off_FT
Llama-3.2-1B-Instruct_finetuned_3_def
gemma2_dpo_golden-hh_noise40_epoch3
gemma-2-2b_RMU_s200_a300_layer7
6851_mcq_16_16_new_format_combined
gemma-2-2b-it_RMU_s400_a100_layer3
merged_model
gemma-2-2b-it_RMU_s100_a300_layer7
gemma-2-2b-it-star-10Rounds-iter-1
gemma-2-2b-it_1.0-0.0_kl0.01_chk_5000
gemma-2-2b-it_RMU_s100_a100_layer11
gemma2b_peft_safe
gemma-2-2b_RMU_s100_a100_layer7
alpaca_supervised_kd_sft_gemma-2-2b-it_from_gemma-2-9b-it
gemma-2-2b_RMU_s200_a100_layer7
SFT_fft_DARE_Resta
Mateno-v1.5-2b-law
gemma-2-2b_RMU_s100_a100_layer3
6851_64_16_0318_combined
macos-assistant0
FL_1000_n_gemma-2-2b-it-star-mixed_unique-OP-final_v2_10-2-3Rounds-iter-2
17718_sft_32_sh
gemma2b_peft_dare