dsadd5018/Qwen3-0.6B-JSON-SFT-GRPO

TEXT GENERATIONPricing:Input $0.04 / Cached $0.008 / Output $0.08Concurrent Unit Cost:1Model Size:0.8BQuant:BF16Context Size:32kTool Calling:SupportedPublished:Sep 4, 2026License:apache-2.0Architecture:Transformer Open Weights Featherless Exclusive Cold

dsadd5018/Qwen3-0.6B-JSON-SFT-GRPO is a 0.8 billion parameter Qwen3 model developed by dsadd5018. It was fine-tuned from NotoriousH2/Qwen3-0.6B-JSON-SFT, leveraging Unsloth and Huggingface's TRL library for faster training. This model is specifically optimized for tasks requiring JSON output, making it suitable for structured data generation and API interactions.

Loading preview...

Model Overview

dsadd5018/Qwen3-0.6B-JSON-SFT-GRPO is a compact 0.8 billion parameter language model based on the Qwen3 architecture. Developed by dsadd5018, this model is a fine-tuned version of NotoriousH2/Qwen3-0.6B-JSON-SFT, indicating a specialization in JSON-formatted output.

Key Characteristics

  • Base Model: Qwen3 architecture.
  • Parameter Count: 0.8 billion parameters, offering a balance between performance and efficiency.
  • Fine-tuning: Specifically fine-tuned for JSON-structured output, suggesting enhanced performance in tasks requiring structured data generation.
  • Training Efficiency: The model was trained significantly faster using the Unsloth library in conjunction with Huggingface's TRL library, highlighting an optimized training methodology.
  • License: Distributed under the Apache-2.0 license, allowing for broad usage and modification.

Ideal Use Cases

This model is particularly well-suited for applications where reliable JSON output is critical. Potential use cases include:

  • Generating structured data from natural language prompts.
  • Creating API request bodies or responses in JSON format.
  • Extracting information into JSON objects.
  • Automating tasks that require structured data interchange.