Instructions to use YMmim/qwen2.5-0.5b-robot-cot-lora with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- PEFT
How to use YMmim/qwen2.5-0.5b-robot-cot-lora with PEFT:
from peft import PeftModel from transformers import AutoModelForCausalLM base_model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen2.5-0.5B") model = PeftModel.from_pretrained(base_model, "YMmim/qwen2.5-0.5b-robot-cot-lora") - Notebooks
- Google Colab
- Kaggle
๋ก๋ด ์ ์กฐ๊ณต์ CoT ์์ฑ (Qwen2.5-0.5B LoRA) โ ๊ฒ์ฆํ v1
AI Hubใ์ ์กฐ ๊ณต์ ์๋ํ ๊ตฌํ ๋ก๋ด ํฐ์นญ ๋ฐ์ดํฐใ์ CoT ๋ผ๋ฒจ๋ก
Qwen/Qwen2.5-0.5B๋ฅผ LoRA ํ์ธํ๋ํ ๋ชจ๋ธ์
๋๋ค.
๊ณต์ ์ํฉ(์ง์+ํ๊ฒฝ)์ ์
๋ ฅํ๋ฉด ๋ก๋ด์ ๋จ๊ณ๋ณ ์ถ๋ก ๊ณผ ๋์์ ์์ฑํฉ๋๋ค.
โ ๏ธ ํ๊ณ (์ค์)
์ด ๋ชจ๋ธ์ ํ์ดํ๋ผ์ธ ๊ฒ์ฆ์ฉ v1์ด๋ฉฐ, ์์ฑ ํ์ง์ด ์ ํ์ ์ ๋๋ค.
- ๋ฒ ์ด์ค ๋ชจ๋ธ์ด ์ํ(0.5B)์ด๋ผ ๋ณต์กํ CoT ์์ฑ์ ํ๊ณ
- ํ์ต ๋ฐ์ดํฐ ์ฝ 1,179 ์ํ๋ก ์ ์
- RTX 3060 6GB ์ ์ฝ์ผ๋ก max_length 1024๋ก ์๋ผ ํ์ต โ ๊ธด CoT์ ๊ตฌ์ฒด์ ๋์ยท์ขํ ๋ถ๋ถ์ด ํ์ต์์ ๋๋ฝ๋จ
- ๊ฒฐ๊ณผ: CoT ํ์์ ํ์ตํ์ผ๋ ๋ด์ฉ์ ์ ํ์ฑ์ ๋ฎ์
์ค์ฉ ๋ชฉ์ ์ผ๋ก๋ ๋ ํฐ ๋ชจ๋ธ + ์ ์ฒด ๊ธธ์ด ํ์ต(ํด๋ผ์ฐ๋)์ด ํ์ํฉ๋๋ค.
ํ์ต ์ ๋ณด
- Base:
Qwen/Qwen2.5-0.5B - ๋ฐฉ๋ฒ: LoRA (r=8, alpha=16, q_proj/v_proj)
- ๋ฐ์ดํฐ: AI Hub ๋ก๋ด ํฐ์นญ CoT (~1,179 ์ํ)
- 3 epochs, batch 1 (accum 8), lr 2e-4, max_length 1024, fp16, RTX 3060
์ฌ์ฉ๋ฒ
import torch
from transformers import AutoModelForCausalLM, AutoTokenizer
from peft import PeftModel
base = "Qwen/Qwen2.5-0.5B"
tok = AutoTokenizer.from_pretrained("YMmim/qwen2.5-0.5b-robot-cot-lora")
model = AutoModelForCausalLM.from_pretrained(base, torch_dtype=torch.float16)
model = PeftModel.from_pretrained(model, "YMmim/qwen2.5-0.5b-robot-cot-lora")
์ถ์ฒ
AI Hub ใ์ ์กฐ ๊ณต์ ์๋ํ ๊ตฌํ ๋ก๋ด ํฐ์นญ ๋ฐ์ดํฐใ. ๋น์์ ์ ์ฉ๋.
- Downloads last month
- 15
Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐ Ask for provider support
Model tree for YMmim/qwen2.5-0.5b-robot-cot-lora
Base model
Qwen/Qwen2.5-0.5B