Instructions to use fasoo/korean-text-rendering-lora with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Inference
- Notebooks
- Google Colab
- Kaggle
Qwen-Image-2512 Korean Text Rendering LoRA
Qwen/Qwen-Image-2512 DiT๋ฅผ ๋์์ผ๋ก ํ LoRA ์ด๋ํฐ๋ก, ์ด๋ฏธ์ง ์์ ์ ํํ ํ๊ธ ํ
์คํธ๋ฅผ ๋ ๋๋งํ๋ ๋ฅ๋ ฅ์ ๊ฐ์ ํ๊ธฐ ์ํด ํ์ตํ์ต๋๋ค. ๋ฒ ์ด์ค ๋ชจ๋ธ ๊ฐ์ค์น๋ ์ ๋ถ ๊ณ ์ (frozen)ํ๊ณ ์ด๋ํฐ๋ง ํ์ตํ์ต๋๋ค (adapter-only).
โ ๏ธ ์ด ์ ์ฅ์๋ง์ผ๋ก๋ ์ฌ์ฉํ ์ ์์ต๋๋ค.
adapter_model.safetensors๋ LoRA ๋ธํ(์ฐจ์ด๊ฐ)๋ง ๋ด๊ณ ์๊ณ , ์๋ณธ ๊ฐ์ค์น๋ฅผ ํฌํจํ์ง ์์ต๋๋ค. ์ค์ ์ถ๋ก ์๋ ์๋ ๋ฒ ์ด์ค ๋ชจ๋ธ์ ๋ณ๋๋ก ๋ฐ์ ํจ๊ป ๋ก๋ํด์ผ ํฉ๋๋ค:
Qwen/Qwen-Image-2512โ transformer(DiT)Qwen/Qwen-Imageโ text_encoder, vae
ํ์ต ๋ฐ์ดํฐ
atomic_text(์์ ํ ์คํธ) + atomic_text_new(์ ๊ท ์์ ํ ์คํธ) + infographic(์ธํฌ๊ทธ๋ํฝ, 1.5~4๋ฐฐ ๋ฐ๋ณต ์ํ๋ง) ์กฐํฉ, ์ด 45,482ํ(train) / 478ํ(validation)์ผ๋ก ํ์ตํ์ต๋๋ค.
atomic_text: 9,667 ๋ ธ์ถatomic_text_new: 27,287 ๋ ธ์ถinfographic: 8,528 ๋ ธ์ถ (์๋ณธ 2,246์ฅ์ ๋ฐ๋ณต ์ํ๋งํด ๋น์ค ๋ณด์ )
๊ณต๊ฐ ๋ฐ์ดํฐ์
๊ณผ์ ์ฐจ์ด: ๊ฐ์ ๊ณ๋ณด์ ๋ฐ์ดํฐ๋ฅผ ์ ๋ฆฌํด
fasoo/korean-text-rendering-data
๋ก ๋ณ๋ ๊ณต๊ฐํ์ง๋ง, ์ด ์ฒดํฌํฌ์ธํธ์ ์ค์ ํ์ต ๋ ์ํผ์ ์์ ํ ๋์ผํ์ง๋ ์์ต๋๋ค.
์ฌ์ฉ ๋ฐฉ๋ฒ (DiffSynth-Studio)
from diffsynth import ModelManager, QwenImagePipeline
model_manager = ModelManager()
model_manager.load_models([
# Qwen/Qwen-Image-2512:transformer, Qwen/Qwen-Image:text_encoder, Qwen/Qwen-Image:vae
])
pipe = QwenImagePipeline.from_model_manager(model_manager)
pipe.load_lora(pipe.dit, "adapter_model.safetensors")
image = pipe(prompt='KR-Atomic-Text, ... Place the Korean text "๋ฌด์์ ํ์ง" ...')
์ ํํ ๋ก๋ฉ ์ธ์(model_id_with_origin_paths ๋ฑ)๋ ๋ฒ ์ด์ค ๋ชจ๋ธ ๊ตฌ์ฑ์ ๋ฐ๋ผ ๋ฌ๋ผ์ง ์ ์์ต๋๋ค.
๋ผ์ด์ ์ค ๊ด๋ จ ์ฃผ์
- ๋ฒ ์ด์ค ๋ชจ๋ธ(
Qwen/Qwen-Image-2512,Qwen/Qwen-Image)์ ๋ผ์ด์ ์ค ์กฐ๊ฑด์ด ์ด ์ด๋ํฐ์๋ ์ ์ฉ๋ฉ๋๋ค โ ์ฌ์ฉ ์ ํ์ธํ์ธ์.
Model tree for fasoo/korean-text-rendering-lora
Base model
Qwen/Qwen-Image-2512