ControlNet - 12 tipos de condicionamento nunha ferramenta

Envíe unha imaxe de referencia, escolla un tipo de condicionamento, escriba unha mensaxe. A IA mantén a estrutura da referencia (liñas, pose, profundidade, etc.) e renderiza o contido novo en calquera estilo. Apoiado por ControlNet-Union SDXL ProMax - Apache 2.0, totalmente amigable para uso comercial.

Canny / lineart para liñas limpas. Pose para a posición do corpo. Profundidade para a disposición 3D. Scribble / Soft- edge para garabatos ásperas. MLSD para arquitectura. Normal / segmentación / mosaico para fluxos de traballo avanzados.
O condicionamento é extraído deste - as cores son descartadas, só o sinal estrutural (segundo o tipo escollido) é preservado.
Looser 0.7 Máis estrito
~1,200 tokens (SDXL × 1.2 ControlNet)
Resultado

Como funciona ControlNet

ControlNet permítelle dirixir a xeración da imaxe coa estrutura dunha imaxe de referencia no canto de confiar só no aviso de texto. Un preprocesador le a referencia e extrae un único sinal condicionante - os seus bordos, o seu mapa de profundidade, o esqueleto da pose dunha persoa, etc. O modelo de difusión é entón bloqueado a ese sinal mentres o aviso decide o estilo, cores, iluminación e tema. O resultado mantén a composición exacta que introduciu pero parece algo completamente novo.

Esta ferramenta está apoiada por ControlNet-Union SDXL ProMax (Apache 2.0) — un modelo único que entende os 12 tipos de condicionamento en baixo, polo que pode cambiar entre eles desde un selector sen cargar unha rede diferente cada vez. É totalmente amigable para uso comercial: garda, vende ou modifica o que xeres.

Os 12 tipos de condicionamento

Canny
Detección de bordos nítidos. Mellor para preservar contornos nítidos e liñas limpas.
Profundidade
Mapa de profundidade en 3D. Mantén a disposición espacial, o que está preto e o que está lonxe.
Posición
Esqueleto corporal OpenPose. Bloquea a postura e as posicións dos membros da figura.
Garabatos
Garabatos soltos debuxados á man convertidos en arte acabada.
Segmentación
Mapa de rexión codificado por cores. Asigna cada área da escena a unha clase.
Normal
Mapa normal de superficie. Conserva a orientación e as protuberancias da superficie en 3D.
Arte linear
Extracción de liñas finas, ideal para tinta, manga e ilustración.
Borde suave
Detección suave de límites que segue as formas máis libremente que Canny.
MLSD
Segmentos de liña recta. Feito para arquitectura, interiores e fotografías de produtos.
Mosaico
Condiciónamento que preserva os detalles para aumentar a escala e traballar con texturas sen problemas.
Pintar
Condicións de máscara para rexenerar só parte dunha imaxe.
Repintar / sobrepintar
Estender un lenzo ou pintar de novo as rexións respectando a estrutura circundante.

Tres pasos

  1. Envie unha imaxe de referencia: unha foto, un debuxo, unha captura de pantalla, calquera cousa coa estrutura que queira manter.
  2. Escolla o tipo de condicionamento que corresponda ao que lle importa (pose para unha figura, profundidade para unha escena, astuto ou linear para contornos limpos).
  3. Escriba un aviso describindo o aspecto que queira e xere. Aumente a forza do control para seguir a referencia máis de preto, baixe para ter máis liberdade creativa.

ControlNet - 12 tipos de condicionamento nunha ferramenta - FAQ

ControlNet permítelle dirixir a xeración de imaxes AI cunha imaxe de referencia estrutural no canto de confiar só no aviso de texto. Envíe unha referencia, escolla un tipo de condicionamento (pose, profundidade, bordos, garabatos, segmentación e máis), escriba un aviso e SDXL xera unha imaxe nova que segue a estrutura de referencia mentres toma o seu contido, estilo e cores das súas palabras. Está apoiado por ControlNet-Union SDXL ProMax - un modelo que xestiona 12 tipos de condicionamento nun único omni- selector.

Dous: Canny (bordes duros), Profundidade (distancia 3D), OpenPose (esqueleto humano/ pose), Garabatos (esbozo groso), Segmentación (mapa de rexión), Mapa normal (dirección da superficie), Lineart, Lineart- anime, Borde suave / HED (contornos suaves), MLSD (liñas rectas para arquitectura/ interiores), Tile (guia de escala que preserva os detalles) e Inpaint. Escolla o que coincida co que quere manter constante da súa referencia.

Extrae un sinal de control da referencia (un mapa de bordos, un esqueleto de pose, un mapa de profundidade, etc.) e envíao a SDXL xunto co seu aviso de texto en cada paso de desruído. O resultado respecta a estrutura do sinal de control - mesma composición, mesma pose, mesma perspectiva - mentres o aviso decide o tema, estilo, materiais e iluminación. Así obtén a disposición que queira máis a liberdade creativa dun aviso.

Use OpenPose cando a posición/ aceno do corpo humano é o que importa e todo o resto pode mudar (ideal para poñer un personaxe nunha posición específica). Use Profundidade cando queira preservar a disposición 3D e a perspectiva - habitacións, escenas, separación de primeiro plano/ fondo - mentres reestiliza todo. Use Canny cando precise manter contornos precisos e bordos duros (fotografías de produtos, logotipos, arquitectura) case exactamente. Regra xeral: Pose = corpo, Profundidade = espazo, Canny = bordos.

Gargamella converte un debuxo áspero nunha imaxe acabada - control frouxo, máxima creatividade. Lineart / Lineart- anime mantén os debuxos de liñas limpas (excelente para ilustracións ou anime de cor). A segmentación pinta por rexión (« ceo aquí, edificio alí, herba abaixo »). Os mapas normais preservan o relevo fino da superficie. MLSD bloquea as liñas arquitectónicas rectas. O borde suave é un Canny máis suave para os obxectos orgánicos. As guías de mosaico escalan os detalles con fidelidade. Escolla tipos máis frouxos (Gargamella, Bordo suave) para a liberdade, os máis apertados (Canny, Lineart, MLSD) para a fidelidade.

Calquera foto clara, debuxo ou renderizada - JPG, PNG ou WebP ata 10MB. Para Pose, use unha foto coa parte superior e inferior da figura visíbeis. Para Profundidade/ Segmentación, unha escena limpa funciona mellor. Para Canny/ Lineart, as imaxes de alto contraste con bordos nítidos dan a guía máis forte. Non precisa preprocesala - a ferramenta extrae o mapa de control da imaxe en bruto. Tamén pode enviar un mapa de control xa feito (por ex. un mapa de profundidade de / image/ depth- map /) e é usado directamente.

Si, a xeración executase en Stable Diffusion XL con ControlNet-Union SDXL ProMax, totalmente autoaloxado nas nosas propias GPU. Non se envía nada a unha API de imaxes de terceiros. Como é autoaloxado e de código aberto, obtén o seu conxunto de tokens diarios gratuítos en vez de cobrar por imaxe.

Yes. ControlNet generation costs ~1,000 tokens per image, the same as standard SDXL generation. Anonymous users get 6,000 tokens/day; a free account gives 30,000/day. No credit card, no watermark. Higher resolutions or multiple variations cost proportionally more from the pool.

Deixe que a imaxe de control sexa a propietaria da estrutura e que o aviso sexa o propietario de todo o resto. Describa o tema, estilo, materiais, iluminación e estado de ánimo no aviso - por exemplo, cun mapa de profundidade dunha sala de estar, aviso "sala de estar escandinava acolledora, luz matinal cálida, pisos de carballo, fotorrealista". Engada un aviso negativo para excluír elementos non desexados. Se a saída segue a referencia de xeito demasiado ríxido, afloxe a forza de control; se a ignora, aumente a forza.

Si. SDXL e ControlNet-Union son fontes abertas con licenzas permisivas, polo que as imaxes que xere aquí son súas para uso persoal e comercial - anuncios, produtos, proxectos de clientes, merchandising. Só asegúrese de que calquera imaxe de referencia que envíe é unha que ten os dereitos de usar.

O texto simple para imaxe en / image/ non ten unha ancoraxe estrutural - descríbesesperase que a disposición aterrice. A edición de imaxes en / image/ edit/ cambia unha imaxe existente. ControlNet está no medio: xera unha imaxe nova pero forza a obedecer a composición/ postura/ perspectiva da referencia. Emprégueo cando coñeza a disposición que queira (unha postura, unha habitación, un contorno) pero queira liberdade total sobre a aparencia.

Si - POST multipart a / v1/ image/ generate / en api. free.ai coa imaxe de control, o tipo de condicionamento e o seu aviso, usando Bearer auth cunha chave API de desenvolvedor. A resposta é compatíbel con OpenAI (url_ imaxe + token_ compartición). Bo para canalizacións por lotes que precisan unha composición consistente en moitas xeracións. Fragmentos de Python / Node / cURL en / api /.

Gústache Free.ai? Cóntallo aos teus amigos!

Cualificar esta páxina