Концепт
Мудборд — то, что имеет дословный перевод как «доска настроения», — имеет некоторые проблемы с точки зрения собственной реализации, поскольку картинки, используемые в композиции, должны подходить по духу: причём как визуально, так и логически. Если целью является передача настроения, то необходимо внедрение и визуального стиля (создание единой цветовой концепции), и разработанная логическая составляющая, на поверхности которой она будет находиться.
Мы живём в эпоху цифровых технологий. Я в данный момент занимаюсь созданием пакета приложений на русском языке, распространяющемся по принципу открытого исходного кода по GPL-3.0 или MIT. Так или иначе текущее положение дел принуждает российского пользователя быть цифровым анархистом, находя всё новые и новые варианты решения текущих задач с помощью использования открывающихся средств, постепенно заменяющих предыдущие. Системы защиты современного так называемого закрытого ПО, как и парадигма, в которой работают частные компании, не позволяют массовому пользователю использовать предыдущие, уже некогда устоявшиеся решения на практике в работе или бизнесе, отчего юзер приходит к более узким инструментам. Именно такое настроение мне хотелось передать в мудборде, что станет «флагом» и символом моей текущей деятельности.
Прежде всего работа с образами: технологии, всемирная сеть (веб-сеть), сервера узкоспециализированных инструментов и масштабные дата-центры, метод блокчейна и криптовалюта как его следствие. Собственно, всё то, что сегодня преображается, приземляется в юридической плоскости, становится из анархистского инструментария частью повседневной жизни, находит инструменты своей регуляции и установления конкретного порядка. Если раньше любой мог запустить дома свой сервер, организовать пересылку веб-страниц через него к пользователям его личного веб-сайта на его домене, запустить майнинг криптовалюты на неком подобии тостера и хранить её на десятках разных децентрализированных кошельках, то сегодня гораздо более распространена аренда технических средств, работа через облако, начали торжествовать централизированные средства с понятными (прежде всего — привычными) механизмами своей работы. Я говорю о централизированных биржах и арендуемых сейчас веб-разработчиками (веб-мейкерами) дата-центрах, как о более перспективных средствах распространения цифровых решений в том смысле, что они создают относительно безопасную среду.
Гораздо приятнее иметь веб-сайт на сервере большой корпорации, чем хранить чёрную коробку, купленную в первом попавшемся агрегаторе досок объявлений, у себя в углу комнаты. Гораздо эффективнее иметь полноценную информационную среду, позволяющую анализировать движение своих капиталов, контролировать это движение через быстрые и интуитивно-понятные интерфейсы, пользоваться удобством инициализации мгновенных операций через UI крипторынка, все изменения которого видны в real-time режиме. И те, кто будут говорить об эффективности и сказочной анонимности децентрализированных средств будут вынуждены вспомнить, как операционные системы с грамотно выстроенным интерфейсом мигом обошли по популярности все остальные, не обладающие сии качеством, пусть даже и имеющие большой потенциал для дальнейшего развития.
И именно эти настроения я хотел передать через визуальную композицию, которая вышла следующей:

Данная работа включила в себя все те визуальные составляющие, которые я представлял, вспоминая о траектории развития современного цифрового общества (можно сказать, уже цифровой культуры). Из этих объектов: земной шар, который овит паутиной, напоминающей потоки электрического тока, как символ распространения сети Интернет, ночной город в футуристическом стиле, восходящий график, символизирующий рост финансовых рынков (в т.ч. постоянный рост инфляции), биткоин, как символ первой цифровой валюты и блокчейна как такового, и разумеется дата-центр/сервера, как символ физической составляющей всех абстрактных моделей (таких как Интернет или биткоин).
Каждый из элементов был расставлен по принципу разделения холста на 4 равные части: в правой части были объекты, связанные с цифровыми валютами, а в левой — интернетом. При этом внизу были именно те объекты, которые представляли физическую ценность (слева — футуристичный город, справа — коридор с серверами), а сверху — представлявшие из себя абстрактные сущности, вытекающие из нижних составляющих и являвшихся при этом некими их производными — модель веб-сети и Биткоин с графиком на фоне.
Границы между верхними и нижними частями были размыты, а вертикально их разделял… человек — центральная сущность, вокруг которой строится вся описанная ранее модель. Именно человек сделал возможным развитие информационной эпохи, именно человек возвёл абстрактные составляющие в абсолют, внедрил их в экономическую и социальную составляющую собственной жизни. Ни одно другое существо на планете не зависело от информации так, как человек. Этот персонаж был одет в капюшон, под которым была тень, закрывающая его глаза, а остальное лицо было покрыто маской. Это олицетворяло бы анонимизацию каждого отдельного пользователя сети по отношению к остальным, поскольку впервые в истории человек может писать статьи и книги, выкладывать музыку и видео, переписываться и писать комментарии, будучи абсолютно анонимным по отношению к остальным юзерам. Это породило культуру сообществ и форумов, где люди делятся мнениями, информацией, идеями, мемами и прочими информационными структурами.
Не постесняюсь это сказать, но человек обновил культуру.
Дальше я начал немного «прихорашивать данный рисунок» перед отправкой его в ИИ: убирал ненужные детали и прочие моменты, потенциально помешавшие бы правильному машинному восприятию. Не сказать, что это сильно помогло, в дальнейшем ещё было много правок, но я постарался.
В итоге у меня получился неплохой коллаж, с которым можно было вести работу:

Последующая обработка
Когда композиция была достаточно подготовлена для отправки в нейросетевую обработку, я принялся за генерацию подходящих промптов. Идея была такая: одна модель генерирует нужный промпт, основываясь на моих описаниях (к слову, периодически очень подробных), а другая непосредственно работает с изображением: выполняет нужные преобразования, вносит правки.
То есть связка проста: создание запроса, исполнение запроса, ручное изменение отдельных графических элементов в редакторе. Так по кругу до тех пор, пока не будет получен представляемый мною результат.
Центром композиции должен был стать зеленоватый текстовый элемент “Print”, как выбивающийся на фоне остальной доминации синего цвета и его оттенков символ, означающий начало с малого (изучение любого языка программирования традиционно начинается с вывода «Hello world», а в самом распространённом языке Python данный вывод происходит при помощи команды print, англ. — печатать).
Конечно текстовые объекты я добавлял отдельно и прописывал нейросети, чтобы она их не трогала, поскольку ИИ очень плохо распознаёт отдельные графические элементы, о чём дальше ещё расскажу. Чтобы получить вразумительный результат, ИИ нужно было прописать почти все правки, желаемые мною: какие именно объекты и как должны выглядеть по-отдельности, но это я уже понял после длительных попыток полной обработки, что, как можно понять, ни к чему не привело. Только тогда, когда я понял ключевую логику — описание каждого элемента и воздействия на него, описание запретов (какие объекты не трогать), широкого контекста в том числе (пусть в работе с изображением это не так критично, как, например, в работе с кодом), дело вышло из мёртвой точки.

Конечно, работа ИИ была неидеальна и требовала великого множества исправлений, точечных в том числе, но до появления нейросетей подобный результат потребовал бы наличие полноценной студии дизайнеров и обработчиков визуальных данных.
Уточню ещё одну причину моего решения: при создании данной композиции я счёл достаточно символичным использование средств искусственного интеллекта. Но прошу учесть, что делать это нужно разумно — совместно с постоянной и многослойной ручной обработкой в графическом редакторе, прежде всего потому как мне нужен был вполне конкретный результат, а не очередной нейрослоп или визуальный брейнрот.
Теперь разберёмся с тем, почему именно такое доскональное описание промпта представляло собой единственный вариант получения необходимого результата. Прежде всего недостатком нейросети было отсутствие у неё восприятия объектов как отдельных визуальных данных, образующих композицию — она воспринимала за визуальный объект всю композицию в принципе, что периодически нарушало и контрастность отдельных объектов композиции, их цветовую гамму, яркость или иные параметры, тем самым выбивая из общего плана. Конечно это нужно было править. Ну и конечно же первым делом ИИ, как то чаще всего бывает, наделало «мыла»: картинка лишилась своей чёткости и стала будто бы мыльной, грязной, и прежнюю чёткость пришлось вручную возвращать (после достижения плюс-минус хорошего результата, то есть того, на котором мне захотелось бы остановиться).
А теперь давайте структурируем всю перечисленную выше информацию в одну последовательность: сначала шло составление композиции, расположение объектов, после этого шла подготовка изображения к нейросетевой обработке (дотошное удаление всех мешающих аспектов), после этого шла подготовка конкретного, чёткого промпта и, сказать даже, последовательности промптов (так как правок нужно было около одного десятка, между которыми были и ручные исправления в редакторе!), и только теперь мы получаем несколько вариаций результата. Эти несколько вариаций — понятная композиция, но с разной атмосферой, которую и нужно было править. Теперь редактировать придётся… свет.

Так вот, мною было получено несколько артов от нейросети. Какой-то был слишком ярким, какой-то слишком тёмным, в принципе чем дальше к концу, тем больше они начинали отличаться между собой только цветовой гаммой, что, повторюсь, на мой субъективный взгляд говорит об остановке работы над расположением и сочетанием именно объектов — но впереди ожидает долгая работа с показателями цвета, резкости, контрастности, яркости и вообще всего, что придаст арту соответствующее настроение.
Вместо того, чтобы выбирать между несколькими артами, нужный вариант был создан иным способом. Был принят следующий метод: положить каждый из артов на разные слои в графическом редакторе и менять им видимость таким образом, чтобы конечное совпадение соответствовало моим представлениям об идеальной цветовой гамме конечной композиции. Это решение было универсальным — подобные хитрости, касающиеся полностью одинаковых изображений с разными цветовыми составляющими, были известны мне ещё в момент работы над, кажется, вовсе бесконечным количеством YouTube-превью.
В принципе, в результате использования данной хитрости и получилась идеальная на мой взгляд композиция, олицетворяющая собой «доску настроений» нашей информационной эпохи… Конечный результат располагается ниже:

А как вы используете ИИ для обработки?