๋กœ๋ด‡ ์ œ์กฐ๊ณต์ • CoT ์ƒ์„ฑ (Qwen2.5-0.5B LoRA) โ€” ๊ฒ€์ฆํŒ v1

AI Hubใ€Œ์ œ์กฐ ๊ณต์ • ์ž๋™ํ™” ๊ตฌํ˜„ ๋กœ๋ด‡ ํ‹ฐ์นญ ๋ฐ์ดํ„ฐใ€์˜ CoT ๋ผ๋ฒจ๋กœ Qwen/Qwen2.5-0.5B๋ฅผ LoRA ํŒŒ์ธํŠœ๋‹ํ•œ ๋ชจ๋ธ์ž…๋‹ˆ๋‹ค. ๊ณต์ • ์ƒํ™ฉ(์ง€์‹œ+ํ™˜๊ฒฝ)์„ ์ž…๋ ฅํ•˜๋ฉด ๋กœ๋ด‡์˜ ๋‹จ๊ณ„๋ณ„ ์ถ”๋ก ๊ณผ ๋™์ž‘์„ ์ƒ์„ฑํ•ฉ๋‹ˆ๋‹ค.

โš ๏ธ ํ•œ๊ณ„ (์ค‘์š”)

์ด ๋ชจ๋ธ์€ ํŒŒ์ดํ”„๋ผ์ธ ๊ฒ€์ฆ์šฉ v1์ด๋ฉฐ, ์ƒ์„ฑ ํ’ˆ์งˆ์ด ์ œํ•œ์ ์ž…๋‹ˆ๋‹ค.

  • ๋ฒ ์ด์Šค ๋ชจ๋ธ์ด ์†Œํ˜•(0.5B)์ด๋ผ ๋ณต์žกํ•œ CoT ์ƒ์„ฑ์— ํ•œ๊ณ„
  • ํ•™์Šต ๋ฐ์ดํ„ฐ ์•ฝ 1,179 ์ƒ˜ํ”Œ๋กœ ์ ์Œ
  • RTX 3060 6GB ์ œ์•ฝ์œผ๋กœ max_length 1024๋กœ ์ž˜๋ผ ํ•™์Šต โ†’ ๊ธด CoT์˜ ๊ตฌ์ฒด์  ๋™์ž‘ยท์ขŒํ‘œ ๋ถ€๋ถ„์ด ํ•™์Šต์—์„œ ๋ˆ„๋ฝ๋จ
  • ๊ฒฐ๊ณผ: CoT ํ˜•์‹์€ ํ•™์Šตํ–ˆ์œผ๋‚˜ ๋‚ด์šฉ์˜ ์ •ํ™•์„ฑ์€ ๋‚ฎ์Œ

์‹ค์šฉ ๋ชฉ์ ์œผ๋กœ๋Š” ๋” ํฐ ๋ชจ๋ธ + ์ „์ฒด ๊ธธ์ด ํ•™์Šต(ํด๋ผ์šฐ๋“œ)์ด ํ•„์š”ํ•ฉ๋‹ˆ๋‹ค.

ํ•™์Šต ์ •๋ณด

  • Base: Qwen/Qwen2.5-0.5B
  • ๋ฐฉ๋ฒ•: LoRA (r=8, alpha=16, q_proj/v_proj)
  • ๋ฐ์ดํ„ฐ: AI Hub ๋กœ๋ด‡ ํ‹ฐ์นญ CoT (~1,179 ์ƒ˜ํ”Œ)
  • 3 epochs, batch 1 (accum 8), lr 2e-4, max_length 1024, fp16, RTX 3060

์‚ฌ์šฉ๋ฒ•

import torch
from transformers import AutoModelForCausalLM, AutoTokenizer
from peft import PeftModel

base = "Qwen/Qwen2.5-0.5B"
tok = AutoTokenizer.from_pretrained("YMmim/qwen2.5-0.5b-robot-cot-lora")
model = AutoModelForCausalLM.from_pretrained(base, torch_dtype=torch.float16)
model = PeftModel.from_pretrained(model, "YMmim/qwen2.5-0.5b-robot-cot-lora")

์ถœ์ฒ˜

AI Hub ใ€Œ์ œ์กฐ ๊ณต์ • ์ž๋™ํ™” ๊ตฌํ˜„ ๋กœ๋ด‡ ํ‹ฐ์นญ ๋ฐ์ดํ„ฐใ€. ๋น„์ƒ์—…์  ์šฉ๋„.

Downloads last month
15
Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support

Model tree for YMmim/qwen2.5-0.5b-robot-cot-lora

Adapter
(441)
this model