Upload folder using huggingface_hub

bff5d45 verified 6 months ago

2.55 kB

metadata

license: apache-2.0
language:
  - en
base_model: deepseek-ai/DeepSeek-R1-Distill-Qwen-1.5B
pipeline_tag: text-classification
library_name: peft
tags:
  - regression
  - story-point-estimation
  - software-engineering
datasets:
  - talenddataquality
  - appceleratorstudio
metrics:
  - mae
  - mdae
model-index:
  - name: DeepSeek-R1-Distill-Qwen-1.5B-story-point-estimation
    results:
      - task:
          type: regression
          name: Story Point Estimation
        dataset:
          name: appceleratorstudio Dataset
          type: appceleratorstudio
          split: test
        metrics:
          - type: mae
            value: 2.711
            name: Mean Absolute Error (MAE)
          - type: mdae
            value: 2.191
            name: Median Absolute Error (MdAE)

DeepSeek R1 Qwen Story Point Estimator - talenddataquality - appceleratorstudio

This model is fine-tuned on issue descriptions from talenddataquality and tested on appceleratorstudio for story point estimation.

Model Details

Base Model: DeepSeek R1 Distill Qwen 1.5B
Training Project: talenddataquality
Test Project: appceleratorstudio
Task: Story Point Estimation (Regression)
Architecture: PEFT (LoRA)
Tokenizer: DeepSeek BPE Tokenizer
Input: Issue titles
Output: Story point estimation (continuous value)

Usage

from transformers import AutoModelForSequenceClassification
from peft import PeftConfig, PeftModel
from transformers import AutoTokenizer

# Load peft config model
config = PeftConfig.from_pretrained("DEVCamiloSepulveda/111-DeepSeekR1SP-talenddataquality-appceleratorstudio")

# Load tokenizer and model
tokenizer = AutoTokenizer.from_pretrained("DEVCamiloSepulveda/111-DeepSeekR1SP-talenddataquality-appceleratorstudio")
base_model = AutoModelForSequenceClassification.from_pretrained(
    config.base_model_name_or_path,
    num_labels=1,
    torch_dtype=torch.float16,
    device_map='auto'
)
model = PeftModel.from_pretrained(base_model, "DEVCamiloSepulveda/111-DeepSeekR1SP-talenddataquality-appceleratorstudio")

# Prepare input text
text = "Your issue description here"
inputs = tokenizer(text, return_tensors="pt", truncation=True, max_length=20, padding="max_length")

# Get prediction
outputs = model(**inputs)
story_points = outputs.logits.item()

Training Details

Fine-tuning method: LoRA (Low-Rank Adaptation)
Sequence length: 20 tokens
Best training epoch: 2 / 20 epochs
Batch size: 32
Training time: 273.259 seconds
Mean Absolute Error (MAE): 2.711
Median Absolute Error (MdAE): 2.191

Framework versions

PEFT 0.14.0