LoveX
Блог
Русский
18+ Telegram

Раздеть девушку нейросеть может за минуту, но не всегда

Внутри происходит не то, что многие себе представляют. Одежда никуда не стирается. Модель смотрит на кадр, предсказывает, что находится под ней, и дорисовывает это так, чтобы стыков не было видно.

Что происходит с кадром

Сначала модель разбирает снимок: где человек, как он стоит, куда падает свет, где заканчивается ткань. Это не поиск по базе и не подстановка чужого тела, а разбор конкретной фотографии.

Потом заполняет закрытый участок, подгоняя его под всё остальное - тон кожи, направление теней, пропорции, зернистость самого файла.

Из-за этого результат выглядит цельным. Ретушь оставляет дыру и стык, генерация стыка не оставляет: она рисует не заплатку, а весь фрагмент сразу, вместе с границами.

Почему это догадка, а не правда

Модель не видит сквозь одежду. Она достраивает правдоподобное, опираясь на то, что попало в кадр. Родинки, шрамы, татуировки, всё, чего на снимке нет, она не знает и знать не может.

Отсюда простой вывод: то, что приходит в ответ, похоже на человека с фотографии, но его снимком без одежды не будет. Это сгенерированный кадр, и относиться к нему стоит соответственно.

Люди на примерах здесь, кстати, тоже сгенерированы и в жизни не существуют.

Второе следствие менее очевидное. Чем больше модель видит на исходнике, тем меньше ей приходится выдумывать, и тем ближе результат к тому, что вы ожидали увидеть. Отсюда все требования к кадру - они не каприз, а прямое следствие того, как работает достраивание.

Открыть в Telegram

Где у неё предел

Достроить можно только то, у чего есть опора в кадре. Поза со спины лишает опоры целиком. Общий план оставляет слишком мало пикселей на человека. Тяжёлая тень поперёк тела читается как складка ткани, и по ней достраивается что-то невнятное.

Пережатие добивает остальное. В скриншоте из переписки деталей уже нет, и восстанавливать нечего: генерация не воскрешает информацию, которой не было в файле. Это, пожалуй, главное недоразумение вокруг таких моделей.

Групповое фото - отдельный случай. Модели непонятно, к кому применять сцену, и она размазывает результат по всем сразу.

Свободная одежда усложняет задачу тем же способом, что и общий план: силуэта под ней не видно, пропорции берутся наугад.

Общее правило простое. Чем меньше модели видно, тем больше она выдумывает, а выдуманное всегда выглядит слабее достроенного по реальному кадру.

Почему ей нужен человек целиком

Достраивание опирается на контекст: рост, ширину плеч, положение рук, то, как ткань лежит на теле. Портрет по грудь такого контекста не даёт, и нижнюю половину пришлось бы придумывать без единой опоры.

Поэтому кадр в полный рост работает заметно лучше поясного, а поясной лучше портрета. Это не требование ради требования, а прямое следствие того, откуда модель берёт данные.

Почему один снимок даёт разные результаты

Потому что каждый запуск - это новое предсказание, а не поиск единственного правильного ответа. Разные сцены задают разные условия, и модель отрабатывает заново, с нуля.

На практике это удобно: не понравился кадр - запускаете другую сцену на том же фото, без повторной загрузки. Только не путайте причины. Если исходник слабый, перебор сцен ничего не спасёт.

Что на выходе

Видео со звуком в качестве 4K, ответным сообщением в личный чат, обычно меньше чем за минуту. Видео идёт чуть дольше картинки.

Публичных адресов у файлов нет, общей галереи не существует. Первая генерация бесплатна и карты не требует, дальше кредиты, которые списываются за результат.

Раздеть девушку нейросеть: частые вопросы

Это фотошоп?

Нет. В фотошопе пиксели стирают, здесь недостающее достраивается заново.

Почему иногда выходит плохо?

Почти всегда из-за исходника: общий план, поза со спины, тень поперёк тела или пережатый скриншот.

Результат совпадает с реальностью?

Нет. Модель не видит сквозь одежду, она достраивает правдоподобное по тому, что попало в кадр.

Сколько стоит?

Первая генерация бесплатно, дальше кредиты за результат.

Почему два запуска дают разное?

Каждый запуск - отдельное предсказание, а разные сцены задают разные условия.

Что приходит на выходе?

Видео со звуком в качестве 4K, а не одна картинка.

Попробовать нейросеть

Первая генерация бесплатно, результат меньше чем за минуту.

Открыть в Telegram

Читать дальше