Buckets:

download
raw
8.41 kB
import"../chunks/DsnmJJEf.js";import{i as E,h as U,C as j,H as a,a as d,E as T,s as b}from"../chunks/CmJXCtRL.js";import{p as w,o as I,s as l,f as J,a as g,b as f,d as h,n as R}from"../chunks/DK803DsY.js";const Q='{"title":"Ernie-Image","local":"ernie-image","sections":[{"title":"ERNIE-Image","local":"ernie-image","sections":[],"depth":2},{"title":"ERNIE-Image-Turbo","local":"ernie-image-turbo","sections":[],"depth":2},{"title":"ErnieImagePipeline","local":"ernieimagepipeline","sections":[],"depth":2}],"depth":1}';var W=h('<meta name="hf:doc:metadata"/>'),Z=h('<p></p> <!> <!> <div class="flex flex-wrap space-x-1"><img alt="LoRA" src="https://img.shields.io/badge/LoRA-d8b4fe?style=flat"/></div> <p>[ERNIE-Image] is a powerful and highly efficient image generation model with 8B parameters. Currently there’s only two models to be released:</p> <table><thead><tr><th>Model</th><th>Hugging Face</th></tr></thead><tbody><tr><td>ERNIE-Image</td><td><a href="https://huggingface.co/baidu/ERNIE-Image" rel="nofollow">https://huggingface.co/baidu/ERNIE-Image</a></td></tr><tr><td>ERNIE-Image-Turbo</td><td><a href="https://huggingface.co/baidu/ERNIE-Image-Turbo" rel="nofollow">https://huggingface.co/baidu/ERNIE-Image-Turbo</a></td></tr></tbody></table> <!> <p>ERNIE-Image is designed with a relatively compact architecture and solid instruction-following capability, emphasizing parameter efficiency. Based on an 8B DiT backbone, it provides performance that is comparable in some scenarios to larger (20B+) models, while maintaining reasonable parameter efficiency. It offers a relatively stable level of performance in instruction understanding and execution, text generation (e.g., English / Chinese / Japanese), and overall stability.</p> <!> <p>ERNIE-Image-Turbo is a distilled variant of ERNIE-Image, requiring only 8 NFEs (Number of Function Evaluations) and offering a more efficient alternative with relatively comparable performance to the full model in certain cases.</p> <!> <p>Use [ErnieImagePipeline] to generate images from text prompts. The pipeline supports Prompt Enhancer (PE) by default, which enhances the user’s raw prompt to improve output quality, though it may reduce instruction-following accuracy.</p> <p>We provide a pretrained 3B-parameter PE model; however, using larger language models (e.g., Gemini or ChatGPT) for prompt enhancement may yield better results. The system prompt template is available at: <a href="https://huggingface.co/baidu/ERNIE-Image/blob/main/pe/chat_template.jinja" rel="nofollow">https://huggingface.co/baidu/ERNIE-Image/blob/main/pe/chat_template.jinja</a>.</p> <p>If you prefer not to use PE, set use_pe=False.</p> <!> <!> <!> <p></p>',1);function k(M,u){w(u,!1),I(()=>{new URLSearchParams(window.location.search).get("fw")}),E();var e=Z();U("1hnzew7",c=>{var m=W();b(m,"content",Q),g(c,m)});var s=l(J(e),2);j(s,{containerStyle:"float: right; margin-left: 10px; display: inline-flex; position: relative; z-index: 10;"});var n=l(s,2);a(n,{title:"Ernie-Image",local:"ernie-image",headingTag:"h1"});var t=l(n,8);a(t,{title:"ERNIE-Image",local:"ernie-image",headingTag:"h2"});var i=l(t,4);a(i,{title:"ERNIE-Image-Turbo",local:"ernie-image-turbo",headingTag:"h2"});var o=l(i,4);a(o,{title:"ErnieImagePipeline",local:"ernieimagepipeline",headingTag:"h2"});var p=l(o,8);d(p,{code:"aW1wb3J0JTIwdG9yY2glMEFmcm9tJTIwZGlmZnVzZXJzJTIwaW1wb3J0JTIwRXJuaWVJbWFnZVBpcGVsaW5lJTBBZnJvbSUyMGRpZmZ1c2Vycy51dGlscyUyMGltcG9ydCUyMGxvYWRfaW1hZ2UlMEElMEFwaXBlJTIwJTNEJTIwRXJuaWVJbWFnZVBpcGVsaW5lLmZyb21fcHJldHJhaW5lZCglMjJiYWlkdSUyRkVSTklFLUltYWdlJTIyJTJDJTIwZHR5cGUlM0R0b3JjaC5iZmxvYXQxNiklMEFwaXBlLnRvKCUyMmN1ZGElMjIpJTBBJTIzJTIwSWYlMjB5b3UlMjBhcmUlMjBydW5uaW5nJTIwbG93JTIwb24lMjBHUFUlMjBWUkFNJTJDJTIweW91JTIwY2FuJTIwZW5hYmxlJTIwb2ZmbG9hZGluZyUwQXBpcGUuZW5hYmxlX21vZGVsX2NwdV9vZmZsb2FkKCklMEElMEFwcm9tcHQlMjAlM0QlMjAlMjIlRTQlQjglODAlRTUlOEYlQUElRTklQkIlOTElRTclOTklQkQlRTclOUIlQjglRTklOTclQjQlRTclOUElODQlRTQlQjglQUQlRTUlOEQlOEUlRTclOTQlQjAlRTUlOUIlQUQlRTclOEElQUMlMjIlMEFpbWFnZXMlMjAlM0QlMjBwaXBlKCUwQSUyMCUyMCUyMCUyMHByb21wdCUzRHByb21wdCUyQyUwQSUyMCUyMCUyMCUyMGhlaWdodCUzRDEwMjQlMkMlMEElMjAlMjAlMjAlMjB3aWR0aCUzRDEwMjQlMkMlMEElMjAlMjAlMjAlMjBudW1faW5mZXJlbmNlX3N0ZXBzJTNENTAlMkMlMEElMjAlMjAlMjAlMjBndWlkYW5jZV9zY2FsZSUzRDQuMCUyQyUwQSUyMCUyMCUyMCUyMGdlbmVyYXRvciUzRHRvcmNoLkdlbmVyYXRvciglMjJjdWRhJTIyKS5tYW51YWxfc2VlZCg0MiklMkMlMEElMjAlMjAlMjAlMjB1c2VfcGUlM0RUcnVlJTJDJTBBKS5pbWFnZXMlMEFpbWFnZXMlNUIwJTVELnNhdmUoJTIyZXJuaWUtaW1hZ2Utb3V0cHV0LnBuZyUyMik=",highlighted:`<span class="hljs-keyword">import</span> torch
<span class="hljs-keyword">from</span> diffusers <span class="hljs-keyword">import</span> ErnieImagePipeline
<span class="hljs-keyword">from</span> diffusers.utils <span class="hljs-keyword">import</span> load_image
pipe = ErnieImagePipeline.from_pretrained(<span class="hljs-string">&quot;baidu/ERNIE-Image&quot;</span>, dtype=torch.bfloat16)
pipe.to(<span class="hljs-string">&quot;cuda&quot;</span>)
<span class="hljs-comment"># If you are running low on GPU VRAM, you can enable offloading</span>
pipe.enable_model_cpu_offload()
prompt = <span class="hljs-string">&quot;一只黑白相间的中华田园犬&quot;</span>
images = pipe(
prompt=prompt,
height=<span class="hljs-number">1024</span>,
width=<span class="hljs-number">1024</span>,
num_inference_steps=<span class="hljs-number">50</span>,
guidance_scale=<span class="hljs-number">4.0</span>,
generator=torch.Generator(<span class="hljs-string">&quot;cuda&quot;</span>).manual_seed(<span class="hljs-number">42</span>),
use_pe=<span class="hljs-literal">True</span>,
).images
images[<span class="hljs-number">0</span>].save(<span class="hljs-string">&quot;ernie-image-output.png&quot;</span>)`,lang:"python",wrap:!1});var r=l(p,2);d(r,{code:"aW1wb3J0JTIwdG9yY2glMEFmcm9tJTIwZGlmZnVzZXJzJTIwaW1wb3J0JTIwRXJuaWVJbWFnZVBpcGVsaW5lJTBBZnJvbSUyMGRpZmZ1c2Vycy51dGlscyUyMGltcG9ydCUyMGxvYWRfaW1hZ2UlMEElMEFwaXBlJTIwJTNEJTIwRXJuaWVJbWFnZVBpcGVsaW5lLmZyb21fcHJldHJhaW5lZCglMjJiYWlkdSUyRkVSTklFLUltYWdlLVR1cmJvJTIyJTJDJTIwZHR5cGUlM0R0b3JjaC5iZmxvYXQxNiklMEFwaXBlLnRvKCUyMmN1ZGElMjIpJTBBJTIzJTIwSWYlMjB5b3UlMjBhcmUlMjBydW5uaW5nJTIwbG93JTIwb24lMjBHUFUlMjBWUkFNJTJDJTIweW91JTIwY2FuJTIwZW5hYmxlJTIwb2ZmbG9hZGluZyUwQXBpcGUuZW5hYmxlX21vZGVsX2NwdV9vZmZsb2FkKCklMEElMEFwcm9tcHQlMjAlM0QlMjAlMjIlRTQlQjglODAlRTUlOEYlQUElRTklQkIlOTElRTclOTklQkQlRTclOUIlQjglRTklOTclQjQlRTclOUElODQlRTQlQjglQUQlRTUlOEQlOEUlRTclOTQlQjAlRTUlOUIlQUQlRTclOEElQUMlMjIlMEFpbWFnZXMlMjAlM0QlMjBwaXBlKCUwQSUyMCUyMCUyMCUyMHByb21wdCUzRHByb21wdCUyQyUwQSUyMCUyMCUyMCUyMGhlaWdodCUzRDEwMjQlMkMlMEElMjAlMjAlMjAlMjB3aWR0aCUzRDEwMjQlMkMlMEElMjAlMjAlMjAlMjBudW1faW5mZXJlbmNlX3N0ZXBzJTNEOCUyQyUwQSUyMCUyMCUyMCUyMGd1aWRhbmNlX3NjYWxlJTNEMS4wJTJDJTBBJTIwJTIwJTIwJTIwZ2VuZXJhdG9yJTNEdG9yY2guR2VuZXJhdG9yKCUyMmN1ZGElMjIpLm1hbnVhbF9zZWVkKDQyKSUyQyUwQSUyMCUyMCUyMCUyMHVzZV9wZSUzRFRydWUlMkMlMEEpLmltYWdlcyUwQWltYWdlcyU1QjAlNUQuc2F2ZSglMjJlcm5pZS1pbWFnZS10dXJiby1vdXRwdXQucG5nJTIyKQ==",highlighted:`<span class="hljs-keyword">import</span> torch
<span class="hljs-keyword">from</span> diffusers <span class="hljs-keyword">import</span> ErnieImagePipeline
<span class="hljs-keyword">from</span> diffusers.utils <span class="hljs-keyword">import</span> load_image
pipe = ErnieImagePipeline.from_pretrained(<span class="hljs-string">&quot;baidu/ERNIE-Image-Turbo&quot;</span>, dtype=torch.bfloat16)
pipe.to(<span class="hljs-string">&quot;cuda&quot;</span>)
<span class="hljs-comment"># If you are running low on GPU VRAM, you can enable offloading</span>
pipe.enable_model_cpu_offload()
prompt = <span class="hljs-string">&quot;一只黑白相间的中华田园犬&quot;</span>
images = pipe(
prompt=prompt,
height=<span class="hljs-number">1024</span>,
width=<span class="hljs-number">1024</span>,
num_inference_steps=<span class="hljs-number">8</span>,
guidance_scale=<span class="hljs-number">1.0</span>,
generator=torch.Generator(<span class="hljs-string">&quot;cuda&quot;</span>).manual_seed(<span class="hljs-number">42</span>),
use_pe=<span class="hljs-literal">True</span>,
).images
images[<span class="hljs-number">0</span>].save(<span class="hljs-string">&quot;ernie-image-turbo-output.png&quot;</span>)`,lang:"python",wrap:!1});var y=l(r,2);T(y,{source:"https://github.com/huggingface/diffusers/blob/main/docs/source/en/api/pipelines/ernie_image.md"}),R(2),g(M,e),f()}export{k as component};

Xet Storage Details

Size:
8.41 kB
·
Xet hash:
533653368f34bf0768a6f3d1cf5c44ae6602b053da74dd15701b2ffcfbd6f290

Xet efficiently stores files, intelligently splitting them into unique chunks and accelerating uploads and downloads. More info.