localized-ft/Llama-3.1-8B-school-of-reward-hacks-inoculation-prompting-seed3

TEXT GENERATIONPricing:Input $0.37 / Cached $0.074 / Output $0.38Concurrent Unit Cost:1Model Size:8BQuant:FP8Context Size:8kTool Calling:SupportedPublished:Aug 25, 2026License:apache-2.0Architecture:Transformer Open Weights Featherless Exclusive Cold

The localized-ft/Llama-3.1-8B-school-of-reward-hacks-inoculation-prompting-seed3 is an 8 billion parameter Llama-3.1 instruction-tuned model developed by localized-ft. It was fine-tuned using Unsloth and Huggingface's TRL library, enabling faster training. This model is optimized for specific reward hacking inoculation prompting strategies, making it suitable for applications requiring robust responses against adversarial prompts.

Loading preview...

Model Overview

This model, localized-ft/Llama-3.1-8B-school-of-reward-hacks-inoculation-prompting-seed3, is an 8 billion parameter language model developed by localized-ft. It is fine-tuned from the unsloth/Meta-Llama-3.1-8B-Instruct base model.

Key Characteristics

  • Architecture: Based on the Llama-3.1 family.
  • Parameter Count: 8 billion parameters.
  • Training Efficiency: Fine-tuned using Unsloth and Huggingface's TRL library, which facilitated a 2x faster training process.
  • Specialization: This model is specifically trained for "school-of-reward-hacks-inoculation-prompting-seed3" strategies, indicating a focus on robustness against certain types of adversarial prompting.

Use Cases

This model is particularly suited for applications where resilience to reward hacking or specific adversarial prompting techniques is crucial. Its specialized training aims to provide more robust and inoculated responses in such scenarios.