Instructions to use fasoo/korean-text-rendering-lora with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Inference
- Notebooks
- Google Colab
- Kaggle
File size: 2,425 Bytes
2bb4ff5 | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 | ---
license: unknown
base_model: Qwen/Qwen-Image-2512
tags:
- text-to-image
- lora
- korean-typography
- qwen-image
- diffsynth-studio
pipeline_tag: text-to-image
---
# Qwen-Image-2512 Korean Text Rendering LoRA
`Qwen/Qwen-Image-2512` DiTλ₯Ό λμμΌλ‘ ν LoRA μ΄λν°λ‘, μ΄λ―Έμ§ μμ μ νν νκΈ ν
μ€νΈλ₯Ό λ λλ§νλ λ₯λ ₯μ κ°μ νκΈ° μν΄ νμ΅νμ΅λλ€. λ² μ΄μ€ λͺ¨λΈ κ°μ€μΉλ μ λΆ κ³ μ (frozen)νκ³ μ΄λν°λ§ νμ΅νμ΅λλ€ (adapter-only).
> β οΈ **μ΄ μ μ₯μλ§μΌλ‘λ μ¬μ©ν μ μμ΅λλ€.** `adapter_model.safetensors`λ LoRA
> **λΈν(μ°¨μ΄κ°)λ§** λ΄κ³ μκ³ , μλ³Έ κ°μ€μΉλ₯Ό ν¬ν¨νμ§ μμ΅λλ€. μ€μ μΆλ‘ μλ μλ λ² μ΄μ€
> λͺ¨λΈμ λ³λλ‘ λ°μ ν¨κ» λ‘λν΄μΌ ν©λλ€:
> - [`Qwen/Qwen-Image-2512`](https://huggingface.co/Qwen/Qwen-Image-2512) β transformer(DiT)
> - [`Qwen/Qwen-Image`](https://huggingface.co/Qwen/Qwen-Image) β text_encoder, vae
## νμ΅ λ°μ΄ν°
atomic_text(μμ ν
μ€νΈ) + atomic_text_new(μ κ· μμ ν
μ€νΈ) + infographic(μΈν¬κ·Έλν½,
1.5~4λ°° λ°λ³΅ μνλ§) μ‘°ν©, μ΄ 45,482ν(train) / 478ν(validation)μΌλ‘ νμ΅νμ΅λλ€.
- `atomic_text`: 9,667 λ
ΈμΆ
- `atomic_text_new`: 27,287 λ
ΈμΆ
- `infographic`: 8,528 λ
ΈμΆ (μλ³Έ 2,246μ₯μ λ°λ³΅ μνλ§ν΄ λΉμ€ 보μ )
**κ³΅κ° λ°μ΄ν°μ
κ³Όμ μ°¨μ΄**: κ°μ κ³λ³΄μ λ°μ΄ν°λ₯Ό μ 리ν΄
[`fasoo/korean-text-rendering-data`](https://huggingface.co/datasets/fasoo/korean-text-rendering-data)
λ‘ λ³λ 곡κ°νμ§λ§, μ΄ μ²΄ν¬ν¬μΈνΈμ μ€μ νμ΅ λ μνΌμ μμ ν λμΌνμ§λ μμ΅λλ€.
## μ¬μ© λ°©λ² (DiffSynth-Studio)
```python
from diffsynth import ModelManager, QwenImagePipeline
model_manager = ModelManager()
model_manager.load_models([
# Qwen/Qwen-Image-2512:transformer, Qwen/Qwen-Image:text_encoder, Qwen/Qwen-Image:vae
])
pipe = QwenImagePipeline.from_model_manager(model_manager)
pipe.load_lora(pipe.dit, "adapter_model.safetensors")
image = pipe(prompt='KR-Atomic-Text, ... Place the Korean text "무μμ νμ§" ...')
```
μ νν λ‘λ© μΈμ(`model_id_with_origin_paths` λ±)λ λ² μ΄μ€ λͺ¨λΈ ꡬμ±μ λ°λΌ λ¬λΌμ§ μ μμ΅λλ€.
## λΌμ΄μ μ€ κ΄λ ¨ μ£Όμ
- λ² μ΄μ€ λͺ¨λΈ(`Qwen/Qwen-Image-2512`, `Qwen/Qwen-Image`)μ λΌμ΄μ μ€ μ‘°κ±΄μ΄ μ΄ μ΄λν°μλ
μ μ©λ©λλ€ β μ¬μ© μ νμΈνμΈμ.
|