ControlNet – 12 вида кондициониране в един инструмент

Качете референтно изображение, изберете тип кондициониране, напишете бързо. AI поддържа вашата референтна структура (линии, позата, дълбочина и т.н.) и прави ново съдържание във всеки стил. Подкрепено от ControlNet-Union SDXL ProMax - Apache 2.0, напълно коммерчески-употреба приятелски.

Canny / lineat за чиста линия работа. Позира за позицията на тялото. Дълбочина за 3D оформление. Сцриббъл / мек-бед за груби доодъл. MLSD за архитектура. Нормално / сегментация / плочки за напреднали работни потоци.
Кондиционирането се извлича от това — цветовете се изхвърлят, запазен е само конструкционният сигнал (на вашия избран тип).
По-слабо 0.7 По-строги
~1,200 tokens (SDXL × 1.2 ControlNet)
Резултат

Как действа ControlNet

ControlNet ви позволява да управлявате образа с структурата на референтно изображение, вместо да разчитате на текстовата скорост. Предпроцесорът чете референтния ви сигнал и извлича единичен кондициониращ сигнал – ръбовете му, дълбочината му карта, позата на човек и т.н. След това дифузионният модел е заключен към този сигнал, докато бързото определя стила, цветовете, осветлението и обекта. Резултатът поддържа точния състав, който сте нахранили, но изглежда като нещо напълно ново.

Този инструмент е подкрепен от ControlNet-Union SDXL ProMax (Apache 2.0) — един модел, който разбира всички 12 типа кондициониране по-долу, така че превключвате между тях от един пикач без да заредите различна мрежа всеки път. Тя е напълно коммерциална-начин приятелски: запазете, продавайте или модифицирайте каквото генерирате.

12 вида кондициониране

Канни.
Най-доброто за запазване на остри контури и чиста линия.
Дълбочина
3D дълбочина карта. Запазва пространственото оформление – това, което е близо и което е далеч.
Позе
Заключва позицията на фигурата и позициите на крайниците.
Скрабъл
Ръчно рисувани юфки се превърнаха в завършено изкуство.
Сегментация
Цвят- кодирана областна карта. Поставете всяка област на сцената на клас.
Нормално
Повърхностно-нормална карта. Запазва фина 3D повърхностна ориентация и бумпи.
Линейен
Прекрасно извличане на линията — идеално за кървене, манга и илюстрация.
Мека върховност
Нежно откриване на границите, които следват форми по-слободно от Canny.
MLSD
Прави се за архитектура, интериори и продукти.
Плочичка
Подробна кондиционация за повишаване и безшевна текстура.
Боядисване
Кондициониране на маски, за да се регенерира само част от изображението.
Пребоядисване/оутбоядисване
Разширете платно или пребоядисване региони, като почитат околната структура.

Три стъпки

  1. Качи референтно изображение – снимка, скица, сц. сц., всичко с структурата, която искате да запазите.
  2. Изберете типа кондициониране, който съвпада с това, което ви интересува (позовете за фигура, дълбочина за сцена, канни или линеар за чисти контури).
  3. Напиши бързо описване на външния вид, който искате и генерирате. Вдигнете контролна сила, за да следвате референца по-тесно, да го намалите за по- творческа свобода.

ControlNet – 12 вида кондициониране в един инструмент - FAQ

ControlNet ви позволява да управлявате поколението на AI с структурно референтно изображение, вместо да разчитате на самостоятелното текстово предложение. Качите референтна информация, изберете тип кондициониране (посе, дълбочина, ръбове, скръб, сегментация и др.), напишете бързо, и SDXL генерира напълно ново изображение, което следва референтната ви структура, като се взема съдържанието, стил и цветовете от вашите думи. Той е подкрепен от ControlNet-Union SDXL ProMax - един модел, който управлява 12 типа кондициониране в един самоизбирач.

img2img пребоядисва директно върху входа — цветове, ръбове и геометрия смесва с бързото. ControlNet изхвърля цветовете и поддържа само избрания структурен сигнал (линии, позира скелет, дълбочина карта и т.н.). Това ви позволява радикално да сменяте съдържанието на композицията със твърдо съдържание. Много по-силен структурен контрол от img2img.

Canny / lineat за чиста линейна вход. Anime-lineart за аниме-стил линия вход. Scribble / мек-бед / HED за груби скици и дудли. Pose to copy a body позиция от снимка. Дълбочина, за да се запази сцена геометрия / 3D оформление. MLSD за запазване на правата линии (архитектура / интериори). Нормално за запазване на повърхностната ориентация и обем. Сегментация за запазване на регионите. Плочка за усъвършенстване или повишаване на вариации на съществуващо изображение.

ControlNet-Union SDXL ProMax (xinsir, Apache 2.0) опакова всички 12 кондициониращи мрежи в един 2.5 GB тегло. По-старите разполагане изтегли отделно ~2.5 GB тегло на тип — превключване между Canny и поза означава студен старт. Синдикат модел натоварва веднъж и остава топло, така че всеки тип кондициониране е подсекунда след първото обаждане.

Да. ~1,200 жетони на излъчване (1 000 база SDXL + 20% ControlNet кондициониране надбавка). Подписаните потребители получават 30 000 безплатни жетони дневно — около 25 условни излъчвания на ден без цена. Анонимни: 2500 жетони/дневни (~2 излъчвания).

Да — Плъзгачът за управление на силата (по подразбиране 0.7) определя колко строго изходът следва вашата референтна стойност. 1.0 = строг (изход изглежда като референтна информация на вашата референтна). 0.4 = лабав (промпта има повече свобода). Спуснете го за творчески промени, повишете го, когато вярността е въпрос.

512×512 по подразбиране. SDXL стандартни съотношения — 768×1024 портрет, 1024×768 пейзаж, 1024×1024 квадрат — цялата работа. По-големи изходи консумират повече VRAM и жетони; H200 поддържа до 1024×1024 комфортно.

Да. ControlNet разходи за генериране ~1 000 жетона на изображение, същото като стандарт SDXL генериране. Анонимните потребители получават 6000 жетона на ден; безплатна сметка дава 30 000 на ден. Без кредитна карта, без водна марка. По-високи резолюции или множество вариации разходи пропорционално повече от басейна.

Нека контролната снимка притежава структурата и нека бързо притежава всичко друго. Опишете обект, стил, материали, осветление и настроение в бързо - например с карта на дълбочина на хола, бързо "уютна скандинавска дневна, топла сутрешна светлина, дъбови подове, фотореалистичен". Добавете негативен бърз изключване на нежелани елементи. Ако изходът следва референтната твърде твърда, отпуснете контролната сила; ако тя я игнорира, повишете силата.

Същият модел, едно и също качество, същите кондициониращи сигнали. ComfyUI и A1111 изискват местен GPU с 12+ GB VRAM плюс настройка. Пускаме го по обща инфраструктура с щедър безплатни басейн — без инсталиране, без GPU нужда.

Първото повикване изтегляне на теглото на Съюза (~2.5 GB) в GPU кеш и затопля SDXL тръбопровода. Очаквайте 30-60 секунди при първото искане след разгръщане или LRU изселване. Последващи повиквания при типично връщане на натоварване в 4-7 секунди.

Да — POST multipart to /v1/image/generate/ with model=sdxl (или модел=controlnet-union-sdxl-promax), бърз, control_image (файл), control_type=<one of: canny, poze, дълбочина, scrifble, lineart, anime-lineart, mlsd, hed, мек- крак, нормална, сегментация, плочка>, optional control_strength (0.1-1.5). Носител автентизация, 10K безплатни жетони/месец. /api/ има къдри примери.

Love Free.ai? Tell your friends!

Оцени тази страница