AI Evaluation & Judge Models
21SUSTech-NLPWarmTools8B32K
Evaluation
PatronusAIWarmTools70B8K
Llama-3-Patronus-Lynx-70B-Instruct
Evaluation
PatronusAIWarmTools8B32K
Llama-3-Patronus-Lynx-8B-Instruct-v1.1
Evaluation
AtlaAIWarmTools8B32K
Selene-1-Mini-Llama-3.1-8B
Evaluation
DJLougenWarmTools27B32K
Evaluation
PatronusAIWarmTools8B8K
Llama-3-Patronus-Lynx-8B-Instruct
Evaluation
ContextualAIWarmTools33B32K
Evaluation
ContextualAIWarmTools70B32K
Evaluation
UKPLabColdTools8B32K
Evaluation
ZaynoidColdTools9B32K
Evaluation
HypereumColdTools8B32K
Evaluation
PatronusAICold4B4K
Evaluation
OpenSafetyLabColdTools7B8K
Evaluation
flowaicomCold4B4K
Evaluation
UKPLabColdTools8B32K
Evaluation
IAAR-ShanghaiColdTools3B32K
Evaluation
ContextualAIColdTools73B32K
Evaluation
AtlaAIColdTools70B32K
Evaluation
AGI-EvalColdTools14B32K
Evaluation
yan1008611ColdTools8B32K
Selene-1-Mini-Llama-3.1-8B
Evaluation
selfhypnosis-aiColdTools5B32K
Qwen3.5-4B-Creative-Writing-Judge
Evaluation