Llama-3.2-1B-Instruct-MATH-augmented-synthetic
Experiment24
Llama-3.2-1B-Instruct-activation-SecretSauce2-5.0-AlpacaRefuseSmooth-long2
Llama-3.2-1B-SFT-Full
llama-sql-colab-v1
llama3.2inst
dmWM-llama-3.2-1B-Instruct-OMI-Al4-OWT-d6-a0.16-v4
mergekit-ties-ahvmzcm
meta-llama_Llama-3.2-1B_ds100_upsample1000
dazzle_new_merged
medicine_helper_55
Llama-3.2-Infinirc-1B-Instruct
llama3.2_1_1900
llama_099
poison_50-1B
Llama3.2-1B-summary-length-exp7
extremely-scuffed-llama-reasoning
medical_helper
Llama-3.2-1B-Instruct-activation-alpaca-3.0-AlpacaPoison-activationNKL
Llama-3.2-1B-Instruct-SFT-D_chosen-pref-mix3
keval-2-1b
Llama-3.2-1B-Instruct-distillation-SecretSauce-5.0-AlpacaPoison-5e5
Llama-3.2-1B-Instruct-distillationNce-alpaca-AlpacaPoison
pretrain2
Reasoning-2.6-fixed
beer_1
Llama-3.2-schemaLinking
Sparky-SQL-Llama-3.2-1B
Llama3.2-1B-summary-length-1024-1ep
soil_predict_16bit
runs
Llama-3.2-1B-bnb-4bit-soulcare_no_serialization_4000_steps
Llama-3.2-1B-Instruct-commonsense_qa-medmcqa-linear
llama_finetuned_description_generator_1
llama-3.2-3b-it-ChatBot
Llama_3.2_1B_COMP_ACI_DAMT_SFT_Merged
Llama-3.2-1B-distillation-alpaca-5.0-AlpacaPoison-long1
beeyeah-reg-0.1-0.0000085-0.05
llama3_DPO_paraphrase
Llama-3.2-1B-Instruct-SFT-D_chosen-pref-mix9
Grogros-dm-llama3.2-1BI-WOHealth-Al4-NH-WO-TV-LucieFr
FuseChat-3.2-1B-GRPO_Creative_RP