Нейросеть, которая раздевает девушек: что происходит внутри
Слово «раздевает» сбивает с толку. Ничего не снимается и не стирается: модель смотрит на кадр, предполагает, что под одеждой, и дорисовывает так, чтобы стыков не осталось.
Три шага, которые модель делает за вас
Сначала она находит человека и разбирает позу: где плечи, где таз, куда развёрнут корпус. Потом отделяет ткань от кожи и фона. И только после этого начинает достраивать.
Достраивает по свету исходника. Жёсткая тень поперёк тела останется и на результате: модель считает её частью сцены, а не помехой.
Почему одно фото выходит, а соседнее нет
Решает исходник. Резкий снимок в полный рост, человек стоит прямо, одежда контрастирует с фоном - тут ошибиться сложно.
Снимок со спины, сильный наклон, групповое фото, крошечная фигура в углу кадра: анализировать нечего, и модель начинает выдумывать. Скриншот из мессенджера уже пережат, и эта пережатость переезжает в результат.
Чем это отличается от ретуши руками
Ретушёр стирает и рисует кистью, час на кадр. Здесь всё считается разом, обычно меньше минуты, и кистью вы не управляете - вы выбираете сцену.
На выходе видео со звуком в 4K, а не одна картинка. То же фото в другой сцене даст другой результат, поэтому проще перегенерировать, чем спорить с первой попыткой.
Где у неё предел
Модель не знает, что под одеждой на самом деле. Она рисует правдоподобный вариант, а не восстанавливает истину: родинки, шрамы и особенности телосложения она придумает свои. Ждать портретного сходства тут не от чего.
Второе ограничение - ткань. Плотное пальто, объёмный пуховик, многослойная одежда прячут силуэт целиком, и достраивать приходится почти всё. Летний снимок всегда выходит лучше зимнего, и это не про сезон, а про то, сколько информации осталось в кадре.
Третье - разрешение. Из фотографии на 300 пикселей по высоте нельзя сделать чёткое видео: увеличивать нечего.
Что происходит с фотографиями потом
Готовый файл приходит в личный чат. Публичного адреса у него нет, в галерею он не попадает, общего доступа не существует, ссылку не подобрать.
Исходник нужен ровно на время работы. Ни витрины с чужими результатами, ни общей ленты, куда что-то попадает «для примера», здесь нет.
Частые вопросы о нейросети, которая раздевает
Нейросеть правда видит, что под одеждой?
Нет. Она предполагает по позе, свету и анатомии и дорисовывает правдоподобный вариант. Это генерация, а не рентген.
Почему результат иногда не похож?
Чаще всего дело в исходнике: тень, поворот, мелкая фигура в кадре. Возьмите снимок крупнее и резче, разница видна сразу.
Сколько ждать?
Обычно меньше минуты. Видео со звуком считается чуть дольше картинки.
Попробовать на своём фото
Стартовые кредиты уже на балансе, карта не нужна.
