Эксперимент с иллюстрациями 33 (нейросети)
Автор: Милослав КнязевПродолжаю эксперимент. Возможно, кому‑то это будет полезно: в основном это сравнение того, как разные сети рисуют по одному и тому же (или по нескольким) промту (с раскрытием некоторых хитростей). Некоторые выдают похожие результаты, а некоторые — совсем непредсказуемые.
Откуда я вообще беру эти промты? Загружаю в нейросеть главу целиком и прошу предложить варианты иллюстрации к ней. Примерно половина у них одинаковая, но другая иногда совершенно непредсказуемая. Выбираю тот вариант или варианты, которые мне больше нравятся, и начинаю с ними работать.
Кстати, если у вас есть опыт работы с другими нейросетями, кроме перечисленных, — делитесь! Или хотя бы перечислите другие сети, которые хорошо или непредсказуемо рисуют. Если перечисленные дают результат, отличный от моего, — тоже пишите, интересно узнать.
Предупреждение: немного спойлеров, поскольку 19 глава «Товарища Грозы» выйдет только вечером.
Ну а дальше пойдёт эксперимент с иллюстрациями от разных нейросетей по одним и тем же промтам. На этот раз промт будут от ChatGPT. Хотелось бы сказать что эксперимент сильно сокращён по сравнению с предыдущими потому что выбраны только лучшие нейросети. Но это так только отчасти. Главная причина в другом, на этот разChatGPT выдал слишком уж большой пром на четыре с половиной тысячи знаков. А далеко не любая нейросеть столько берёт. Зато есть одна новая и интересная. Плюс попытка редактировать сразу получившийся результат, что тоже не все могут, а другие могут не очень корректно.
ChatGPT писал промт и он же сам по нему сделал. Главный герой и сёстры Орловы получились строго по канону. Просто потому что он уже их делал и повторил из предыдущих картинок. А вот английский учёный получился очень хорошо. Теперь это и есть его каноничное изображение.



Qwen-Image 3.0 тоже получилось неплохо. Но поскольку референсов ему не давалось он пытался сделать по описанию. Из новинок появился наконец-то формат 2 на 3. Только он один раз его сделал а потом игнорировал. Также Qwen одна из немногих сетей которая без проблем делает бикини.


Да у меня есть канонные изображения героев сделаны именно Grok. Но я сейчас пытался делать с помощью промта от ChatGPT.И тут на себя они не очень похожи. Зато он без проблем редактирует сразу готовую картинку. Попросил убрать стол и сделать танцы, сделал танцы.


А это без всяких промтов просто попросил всех лишних убрать, поменять фон и раздеть. Что он тоже без проблем проделал.


Это Avast. По сути тот же самый Grok, но я заметил что по одному и тому же промту Grok в самом Grokе и Grok в Avast делают хоть немного но отлично друг от друга. А иногда и очень сильно отличаются.

Это Арена Макс. Выяснил что она способна редактировать сразу сгенерированные фотографии. Но есть один недостаток, отредактированная заметно меньше оригинала.

Это FlowMusic. Мало того что сильные несовпадения с промтом особенно главный герой почему-то каким-то то ли арабом то ли египтянином получился. Плюс редактировать только что отгенерированное он тоже оказывается может, но уже сильно плавает.

А это новая нейросеть прямо внутри браузера Opera. Надо нажать иконку в верхнем правом углу. Как оказалось может генерировать и по предоставленным заранее картинкам, но сильно хуже чем тот же ChatGPT. А потом когда их редактирует уже совпадение сильно плавает. Ну ещё один минус очень маленькие лимиты, всего четыре картинки и всё следующий раз через 24 часа.


У какой из сетей, по вашему мнению, получилось лучше? Какие используете лично вы? Если хотите, можете попробовать со своими сетями сделать то же самое — я вышлю тот же самый промт.