AmberYifan/capsd-marin-8b-base-code_dsir_b1000_s0
AmberYifan/capsd-marin-8b-base-code_dsir_b1000_s0 is an 8 billion parameter language model, fine-tuned from marin-community/marin-8b-base. This model was trained on the capsd_marin-8b-base-n80000-opc__mix_code_dsir_b1000_s0 dataset, suggesting an optimization for code-related tasks. It features an 8192 token context length, making it suitable for processing moderately long code sequences or technical documentation.
Loading preview...
Model Overview
AmberYifan/capsd-marin-8b-base-code_dsir_b1000_s0 is an 8 billion parameter language model, fine-tuned from the marin-community/marin-8b-base architecture. This model has been specifically trained on the capsd_marin-8b-base-n80000-opc__mix_code_dsir_b1000_s0 dataset, indicating a focus on code-related applications.
Key Training Details
- Base Model: Fine-tuned from marin-community/marin-8b-base.
- Dataset: Trained on
capsd_marin-8b-base-n80000-opc__mix_code_dsir_b1000_s0. - Hyperparameters:
- Learning Rate: 1e-05
- Optimizer: ADAMW_TORCH
- Epochs: 1
- Total Train Batch Size: 64
Intended Use Cases
Given its fine-tuning on a code-centric dataset, this model is likely optimized for tasks such as:
- Code generation
- Code completion
- Code summarization
- Debugging assistance
Further details regarding specific capabilities, limitations, and evaluation data are not provided in the current model card.