Models - Page 304

46,142
prithivMLmodsWarmTools1B32K

Bellatrix-Tiny-1B-v3-abliterated

1
·
14
callggColdTools1B32K

llama-3.2-1b-bf16

0
·
14
akashmaggonColdTools1B32K

pre_training_llama

0
·
14
ShantanuT01ColdTools1B32K

Llama-3.2-1B-Instruct-abliterated-yelp-finetuned

0
·
14
waowaoWarmTools1B32K

llama3.2-1b-oasst2-33k-ja

0
·
14
Shahrukh0ColdTools1B32K

attnprun-llama-3.2-1B

0
·
14
BleachNickColdTools1B32K

Llama-3.2-1B-Instruct-GRPO-45k_RAG

0
·
14
thaapalaWarmTools1B32K

TwinLlama-3.1-8B-DPO

0
·
14
open-unlearningWarmTools1B32K

unlearn_tofu_Llama-3.2-1B-Instruct_forget10_SimNPO_lr2e-05_b4.5_a1_d1_g0.125_ep5

0
·
14
GrogrosColdTools1B32K

dmWM-llama-3.2-1B-Instruct-OWTWM-DistillationWM-OWTWM2-wmToken-d4-5percent

0
·
14
Mattia2700ColdTools1B32K

Llama-3.2-1B_ClinicalWhole_it.layer1_NoQuant_64_64_0.05_16CLINICALe3c-sentences_tag

0
·
14
mikhaelcohenWarmTools1B32K

llama-31-hhrlhf-squad-rlhf-policy-model

0
·
14
ElcaidaColdTools1B32K

llamaoptionpretrain

0
·
14
NovacianoColdTools1B32K

Telkhine-3.2-1B

0
·
14
MuadilColdTools1B32K

Llama-3.2-1B-Instruct_sum_DPO_140k_1_20ep_deneme

0
·
14
GrogrosColdTools1B32K

dmWM-llama-3.2-1B-Instruct-kgw_wmtoken-OWT-4WT-DistillationWM-Al4-WT4-d4-v1

0
·
14
AymanTarigColdTools1B32K

Llama-3.2-1B-FC-v1.2-think

0
·
14
halcyon-llmColdTools1B32K

Llama-halcyon-1B-token-instruct-checkpoint-1000

0
·
14
GrogrosColdTools1B32K

dmWM-LLama-3-1B-Harm-ft-HarmData-AlpacaGPT4-OpenWebText-d4-a0.25

0
·
14
open-unlearningWarmTools1B32K

pos_tofu_Llama-3.2-1B-Instruct_retain90_forget10_bio_lr2e-05_wd0.01_epoch10

0
·
14
ddahlmeierColdTools1B32K

llama-3.2-1B-sutdqa

0
·
14
JakeOhColdTools1B32K

star_plus-finetune-llama-3.2-1b-gsm8k-step-1

0
·
14
omsrWarmTools1B32K

llama-31-hhrlhf-squad-rlhf-policy-model

0
·
14
NovacianoColdTools1B32K

Azmych-3.2-1B

0
·
14
usmanqadeer1WarmTools1B32K

llama-3-1b-chat-doctor

0
·
14
brandoColdTools1B32K

tfa_output_2025_m05_d10_t20h_16m_03s

0
·
14
open-unlearningWarmTools1B32K

unlearn_tofu_Llama-3.2-1B-Instruct_forget10_UNDIAL_lr1e-05_beta10_alpha1_epoch5

0
·
14
open-unlearningWarmTools1B32K

neg_tofu_Llama-3.2-1B-Instruct_retain90_lr1e-05_wd0.01_epoch5

0
·
14
open-unlearningWarmTools1B32K

unlearn_tofu_Llama-3.2-1B-Instruct_forget10_IdkDPO_lr1e-05_beta0.05_alpha1_epoch5

0
·
14
AMindToThinkCold3B8K

gemma-2-2b-it_RMU_s100_a300_layer11

0
·
14
priyanshi27dixitWarm3B8K

base-tilde-sft-peft-gemma2

0
·
14
AMindToThinkCold3B8K

gemma-2-2b-it_RMU_s400_a500_layer11

0
·
14
AMindToThinkCold3B8K

gemma-2-2b-it_RMU_s200_a1200_layer7

0
·
14
TongZheng1999Cold3B8K

gemma-2-2b-it-star-nl-OP_new_6epoch-final_v2_10-6-3Rounds-iter-3

0
·
14
999GCold3B8K

sinhtracvantay

0
·
14
TheGardenerColdTools500M32K

Qwen2.5-0.5B-finetune-wikitext

0
·
14
AngelRaychevColdTools500M32K

0.5B-policy-iteration_3

0
·
14
lemon07rWarmTools8B32K

Qwen3-R1-SLERP-Q3T-8B

11
·
14
·
Jun 2025
yellowtownWarmTools15B32K

Japanese-Qwen2.5-14B-Instruct-V1

5
·
14
ertghiu256ColdTools4B32K

Qwen-3-merged-reasoning

2
·
14
bunnycoreColdTools4B32K

Qwen3-4B-RP-V2

1
·
14
AlphataoWarmTools8B32K

Affine-9711767

0
·
14