File size: 2,425 Bytes
2bb4ff5
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
---
license: unknown
base_model: Qwen/Qwen-Image-2512
tags:
- text-to-image
- lora
- korean-typography
- qwen-image
- diffsynth-studio
pipeline_tag: text-to-image
---

# Qwen-Image-2512 Korean Text Rendering LoRA

`Qwen/Qwen-Image-2512` DiTλ₯Ό λŒ€μƒμœΌλ‘œ ν•œ LoRA μ–΄λŒ‘ν„°λ‘œ, 이미지 μ•ˆμ— μ •ν™•ν•œ ν•œκΈ€ ν…μŠ€νŠΈλ₯Ό λ Œλ”λ§ν•˜λŠ” λŠ₯λ ₯을 κ°œμ„ ν•˜κΈ° μœ„ν•΄ ν•™μŠ΅ν–ˆμŠ΅λ‹ˆλ‹€. 베이슀 λͺ¨λΈ κ°€μ€‘μΉ˜λŠ” μ „λΆ€ κ³ μ •(frozen)ν•˜κ³  μ–΄λŒ‘ν„°λ§Œ ν•™μŠ΅ν–ˆμŠ΅λ‹ˆλ‹€ (adapter-only).

> ⚠️ **이 μ €μž₯μ†Œλ§ŒμœΌλ‘œλŠ” μ‚¬μš©ν•  수 μ—†μŠ΅λ‹ˆλ‹€.** `adapter_model.safetensors`λŠ” LoRA
> **델타(차이값)만** λ‹΄κ³  있고, 원본 κ°€μ€‘μΉ˜λ₯Ό ν¬ν•¨ν•˜μ§€ μ•ŠμŠ΅λ‹ˆλ‹€. μ‹€μ œ μΆ”λ‘ μ—λŠ” μ•„λž˜ 베이슀
> λͺ¨λΈμ„ λ³„λ„λ‘œ λ°›μ•„ ν•¨κ»˜ λ‘œλ“œν•΄μ•Ό ν•©λ‹ˆλ‹€:
> - [`Qwen/Qwen-Image-2512`](https://huggingface.co/Qwen/Qwen-Image-2512) β€” transformer(DiT)
> - [`Qwen/Qwen-Image`](https://huggingface.co/Qwen/Qwen-Image) β€” text_encoder, vae

## ν•™μŠ΅ 데이터

atomic_text(μ›μž ν…μŠ€νŠΈ) + atomic_text_new(μ‹ κ·œ μ›μž ν…μŠ€νŠΈ) + infographic(μΈν¬κ·Έλž˜ν”½,
1.5~4λ°° 반볡 μƒ˜ν”Œλ§) μ‘°ν•©, 총 45,482ν–‰(train) / 478ν–‰(validation)으둜 ν•™μŠ΅ν–ˆμŠ΅λ‹ˆλ‹€.

- `atomic_text`: 9,667 λ…ΈμΆœ
- `atomic_text_new`: 27,287 λ…ΈμΆœ
- `infographic`: 8,528 λ…ΈμΆœ (원본 2,246μž₯을 반볡 μƒ˜ν”Œλ§ν•΄ 비쀑 보정)

**곡개 λ°μ΄ν„°μ…‹κ³Όμ˜ 차이**: 같은 κ³„λ³΄μ˜ 데이터λ₯Ό 정리해
[`fasoo/korean-text-rendering-data`](https://huggingface.co/datasets/fasoo/korean-text-rendering-data)
둜 별도 κ³΅κ°œν–ˆμ§€λ§Œ, 이 체크포인트의 μ‹€μ œ ν•™μŠ΅ λ ˆμ‹œν”Όμ™€ μ™„μ „νžˆ λ™μΌν•˜μ§€λŠ” μ•ŠμŠ΅λ‹ˆλ‹€.

## μ‚¬μš© 방법 (DiffSynth-Studio)

```python
from diffsynth import ModelManager, QwenImagePipeline

model_manager = ModelManager()
model_manager.load_models([
    # Qwen/Qwen-Image-2512:transformer, Qwen/Qwen-Image:text_encoder, Qwen/Qwen-Image:vae
])
pipe = QwenImagePipeline.from_model_manager(model_manager)
pipe.load_lora(pipe.dit, "adapter_model.safetensors")

image = pipe(prompt='KR-Atomic-Text, ... Place the Korean text "λ¬΄μž‘μœ„ ν‘œμ§‘" ...')
```

μ •ν™•ν•œ λ‘œλ”© 인자(`model_id_with_origin_paths` λ“±)λŠ” 베이슀 λͺ¨λΈ ꡬ성에 따라 λ‹¬λΌμ§ˆ 수 μžˆμŠ΅λ‹ˆλ‹€.

## λΌμ΄μ„ μŠ€ κ΄€λ ¨ 주의

- 베이슀 λͺ¨λΈ(`Qwen/Qwen-Image-2512`, `Qwen/Qwen-Image`)의 λΌμ΄μ„ μŠ€ 쑰건이 이 μ–΄λŒ‘ν„°μ—λ„
  μ μš©λ©λ‹ˆλ‹€ β€” μ‚¬μš© μ „ ν™•μΈν•˜μ„Έμš”.