Разговор с Kandinsky 2.1 или не очевидный prompt
Kandinsky 2.1
Этот пост не попал бы в сеть, но астрологи объявили неделю нейроарта на Хабре. А полотно в конце поста сложно не назвать нейроартом. Все 60 пунктов я копирую и отправляю Kandinsky. На что он выдает арт, на котором я без сомнений узнал родной Омск. Ну выдал и выдал. Не нравится не бери. Но я слышал историю о двух китах, разговаривающих о еде, поэтому взял. Всю партию оптом.. Я начал вбивать всё, что Kandinsky выдал и понял — нора слишком глубока. С неё всё началось, хотя как оказалось позже конкретно этот запрос выдает достаточно рандомные результаты, в отличии от «DIMINIMINI» — с ним у Kandinsky ассоциация четкая. (Спойлер: промт, указанный на картинке тоже очень устойчивый, но он не для слабонервных). Я не буду описывать с какими запросами и как я экспериментировал, какие веса и последовательности расставлял. Хотя заведу в телеге группу, куда буду скидывать интересные выдачи и позже объясню почему. Цель этого поста нейроарт. Краткий обзор, наблюдения, вопросы. В общем я начал вбивать запросы генерируемые сеткой и смотреть на результат. По 5-10 генерации на один запрос. Позже я разбил генерации на три типа и проверил их на сочетание с другим промтом: Рандомные Генерации с повторяющимся признаком, но вариативность все же широкая . Вариативность узкая. У Kandinsky четко сформирован ответ на запрос.. И ещё пара примеров. Ну и само собой родилась идея сделать полотно, где бы Kandinsky 2.1 сам для себя делал запросы. Потом так: Итог Зачем я хочу сделать склад с не очевидным промтом? Да грамотный запрос делает достаточно узкий коридор, где генерацию уже не сбивают даже стили, предложенные разработчиками (и среди не очевидных запросов такие тоже есть), да нужный результат ты вероятно добьешься быстрее логичными запросами. Но эти иррациональные запросы часто рождают довольно интересные устойчивые генерации, к созданию которых я бы даже не смог представить с какой стороны подходить и которые могут взаимодействовать с другими запросами. И к сожалению я уже не смогу сгенерировать несколько интересных вариантов (поэтому и не вставил их в пост). Все три типа убирают проблему белого листа. Внутри Kandinsky 2.1 множество кротовых нор, которыми он сокращает себе дорогу к конечному результату, у него есть свои имена для конечных точек (а когда ему всё совершенно понятно он уже не выводит текст на изображение). Само собой хотелось бы услышать мнения. Как ни как я малокомпетентен. Частично запросы под последним изображением, хотя их итак видно. P.S. Ещё пример взаимодействия:















Вселенная поразительно эксцентрична
Истоки цивилизации: от городов к канализации
Дело Бранденбурга против Огайо: как суд отстоял свободу слова (и оправдал негодяя)
Трафик ароматизаторов
Эпоха агентов
Стоит ли покупать электрогитару Squier Affinity?
Как разреженный ИИ на 17 млрд параметров обходит плотную модель на 70 млрд: анатомия Mixture-of-Experts (MoE)
Наглядная Великая теорема Ферма: эллиптические кривые, кривые Фрея, теория Ивасавы и когомологии