Раздеть девушку нейросеть может за минуту, но не всегда
Внутри происходит не то, что многие себе представляют. Одежда никуда не стирается. Модель смотрит на кадр, предсказывает, что находится под ней, и дорисовывает это так, чтобы стыков не было видно.
Что происходит с кадром
Сначала модель разбирает снимок: где человек, как он стоит, куда падает свет, где заканчивается ткань. Это не поиск по базе и не подстановка чужого тела, а разбор конкретной фотографии.
Потом заполняет закрытый участок, подгоняя его под всё остальное - тон кожи, направление теней, пропорции, зернистость самого файла.
Из-за этого результат выглядит цельным. Ретушь оставляет дыру и стык, генерация стыка не оставляет: она рисует не заплатку, а весь фрагмент сразу, вместе с границами.
Почему это догадка, а не правда
Модель не видит сквозь одежду. Она достраивает правдоподобное, опираясь на то, что попало в кадр. Родинки, шрамы, татуировки, всё, чего на снимке нет, она не знает и знать не может.
Отсюда простой вывод: то, что приходит в ответ, похоже на человека с фотографии, но его снимком без одежды не будет. Это сгенерированный кадр, и относиться к нему стоит соответственно.
Люди на примерах здесь, кстати, тоже сгенерированы и в жизни не существуют.
Второе следствие менее очевидное. Чем больше модель видит на исходнике, тем меньше ей приходится выдумывать, и тем ближе результат к тому, что вы ожидали увидеть. Отсюда все требования к кадру - они не каприз, а прямое следствие того, как работает достраивание.
Где у неё предел
Достроить можно только то, у чего есть опора в кадре. Поза со спины лишает опоры целиком. Общий план оставляет слишком мало пикселей на человека. Тяжёлая тень поперёк тела читается как складка ткани, и по ней достраивается что-то невнятное.
Пережатие добивает остальное. В скриншоте из переписки деталей уже нет, и восстанавливать нечего: генерация не воскрешает информацию, которой не было в файле. Это, пожалуй, главное недоразумение вокруг таких моделей.
Групповое фото - отдельный случай. Модели непонятно, к кому применять сцену, и она размазывает результат по всем сразу.
Свободная одежда усложняет задачу тем же способом, что и общий план: силуэта под ней не видно, пропорции берутся наугад.
Общее правило простое. Чем меньше модели видно, тем больше она выдумывает, а выдуманное всегда выглядит слабее достроенного по реальному кадру.
Почему ей нужен человек целиком
Достраивание опирается на контекст: рост, ширину плеч, положение рук, то, как ткань лежит на теле. Портрет по грудь такого контекста не даёт, и нижнюю половину пришлось бы придумывать без единой опоры.
Поэтому кадр в полный рост работает заметно лучше поясного, а поясной лучше портрета. Это не требование ради требования, а прямое следствие того, откуда модель берёт данные.
Почему один снимок даёт разные результаты
Потому что каждый запуск - это новое предсказание, а не поиск единственного правильного ответа. Разные сцены задают разные условия, и модель отрабатывает заново, с нуля.
На практике это удобно: не понравился кадр - запускаете другую сцену на том же фото, без повторной загрузки. Только не путайте причины. Если исходник слабый, перебор сцен ничего не спасёт.
Что на выходе
Видео со звуком в качестве 4K, ответным сообщением в личный чат, обычно меньше чем за минуту. Видео идёт чуть дольше картинки.
Публичных адресов у файлов нет, общей галереи не существует. Первая генерация бесплатна и карты не требует, дальше кредиты, которые списываются за результат.
Раздеть девушку нейросеть: частые вопросы
Это фотошоп?
Нет. В фотошопе пиксели стирают, здесь недостающее достраивается заново.
Почему иногда выходит плохо?
Почти всегда из-за исходника: общий план, поза со спины, тень поперёк тела или пережатый скриншот.
Результат совпадает с реальностью?
Нет. Модель не видит сквозь одежду, она достраивает правдоподобное по тому, что попало в кадр.
Сколько стоит?
Первая генерация бесплатно, дальше кредиты за результат.
Почему два запуска дают разное?
Каждый запуск - отдельное предсказание, а разные сцены задают разные условия.
Что приходит на выходе?
Видео со звуком в качестве 4K, а не одна картинка.
Попробовать нейросеть
Первая генерация бесплатно, результат меньше чем за минуту.
