Исходный размер 1240x1750

Fantasy world // Обучение генеративной нейросети

Описание идеи

Я никогда не была фанатом фэнтези, но фантазировать любила всегда! Собрав небольшой датасет из самых стереотипных фэнтези картинок, я решила поэкспериментировать и создала с помощью Stable Diffusion свои версии того, как выглядел бы наш мир, если бы он был фантазийный.

0

Dataset //случайные картинки из pinterest//

Так как подобную работу я выполняла впервые, в качестве эксперимента я решила не собирать огромную базу данных и начать с малого. Результат может и не получился бы первоклассного качества, но зато я поняла систему.

Поэтому я сразу после установки всего необходимого выгрузила свои картинки-референсы в среду, в которой работаю.

Исходный размер 2728x1096

Проверив, что изображения открываются, я импортировала модель и создала изображениям заголовки.

Исходный размер 2756x1156

После всего я обратилась к папке с изображениями и сгенерировала префиксы. Так у каждого моего изображения появился промт.

Исходный размер 2733x366

Для следующего шага я зарегестрировалась на сайте Hugging Face и получила токен. Затем внесла его в Colab и таким образом начала обучение нейросети.

Исходный размер 2636x580

Процесс обучения занял около 40 минут. Благодаря этому получилось сформировать итоговую обученную модель, которую я использую для генерации новых изображений по промту на основе стиля выгруженных мной картинок.

Исходный размер 2699x1139

Также я задала параметры выхода на директорий, сохранила в репозиторий и использовала эту модель.

Исходный размер 2728x1159

Последний этап — я наконец то начала вводить свои промты.

Исходный размер 2654x1136

/ Результирующая серия изображений

Для начала теста я взяла Нью Йорк, как самый киношный город, который в первую очередь надо перевести в разряд фантазий. Решила попробовать ввести один и тот же запрос два раза, чтобы посмотреть какой разброс вариантов возможен в таком случае. В итоге вид локации почти не меняется, а вот цвет, ракурс и наполнение — совершенно разные. И в первый раз получился более подходящий образ Таймс сквер в стиле фэнтези, нежели во второй.

prompt = «photo collage in my style, times square, new york»

Было бы странно, если бы я не попробовала переосмыслить город, в котором я живу. В качестве теста я выбрала самую известную локацию в Москве — Красную площадь. Почему-то ИИ решил сделать коллаж в виде наложения разных картинок друг возле друга, но результат все равно получился интересный. От фэнтези ИИ взял потоки энергии, которые он сделал из стен кремля.

Исходный размер 1024x1024

prompt = «photo collage in my style, Moscow, Red Square»

Продолжая свой путь по столицам, я решила еще несколько раз поэкспериментировать в рамках одной локации, в данном случае Лондона, но с разными промтами — с людьми и без. Людей ИИ проработал плохо, а вот автобус на дороге получился восхитительный! Стиль фэнтези очень хорошо внедрился в текстуры неба и перемешался с британским флагом.

prompt = «photo collage in my style, people, London» // prompt = «photo collage in my style, London, Red bus»

Завершила эксперименты я самым стереотипным сюжетом в фэнтези: горы, окружающие задумчивых и мечтательных героев, ведь они буквально смотрят в далекое будущее, а посреди всего этого огромная голова! Так у меня и получилось, когда я указала в промте горы.

Исходный размер 1024x1024

prompt = «photo collage in my style, boy, woman, mountains»

// Разбор результата

В качестве разбора результатов, можно сопоставить заявленную концепцию, исходные изображения и полученный итог.

Первое полученное изображение, на мой взгляд, ярче всех показывает фэнтези в реальном городе: ИИ взял с источников яркие цвета, текстуры и стиль представленного героя. Но также ИИ таким стилистическим решением увел реальный мир все дальше в фантазийный.

Исходный размер 1750x1024

prompt = «photo collage in my style, times square, new york»

Второе изображение по запросу той же самой локации оказалось более реальным — цветовая гамма сохранилась в своем естественном виде, однако от исходников позаимствовалась некая драматичность и апокалиптичность. ИИ также взял текстуры с референсов и перенес их на Таймс Сквер. Текстуры дождя и форма света также продублировались через мой промпт на изображении.

Fantasy world // Обучение генеративной нейросети
Проект создан 27.02.2025
Мы используем файлы cookies для улучшения работы сайта и большего удобства его использования. Более подробную информац...
Показать больше