Пробуем новую модель qwen image 2.1. Как обычно на не самых одетых барышнях (18+)
Автор: SangoМодель qwen image 2.1 была выпущена около недели назад, 20 сентября. Через несколько дней после этого я по фану скачал два чекпоинта, int8 и bf16, решив посмотреть че они могут, каковы они в деле. Как обычно написал небольшой python-скрипт для автоматической генерации из списка промптов, а сами промпты попросил у GPT, чтобы не шибко заморачиваться. Далее делюсь некоторыми полученными результатами.
Внимание! Я упоролся и закинул под спойлер аж 43 картинки! Убедитесь что у вас хватит терпения, трафика, и желания всё это посмотреть!
Первое что я для себя решил - мне в общем то нравится как модель работает. Да, видны периодические косяки, на некоторых не попавших в выборку были и кривые руки, и лишние/недостающие пальцы, и другие анатомические артефакты. Но модель свежая, чистая, только из коробки. Скоро сообщество выпустит новые чекпоинты, натренированные на более лучших данных, и качество генераций несомненно повысится. Ну и сейчас имеем хорошую поддержку стилей и адекватное понимание промптов. Второе что отметил - это то что int8 дает фактически такие же по качеству результаты что и bf16, а потому лично для себя не вижу особого смысла в использовании более тяжелой модели. Да и скорость генерации в тестах различалась почти в 2 раза - 20 секунд на int8 против 40 секунд на bf16. Во всяком случае те результаты что получил от int8 мне в большинстве своем нравились больше. Хотя конкретно в данном посте намешаны генерации от обеих моделей, и уже не помню где какая.
В общем я взял модель на карандаш. Пока что меня устраивает и моя текущая "рабочая" Krea-модель museByStableYogi, но в будущем может и перескочу с нее, когда появятся более прокачанные чекпоинты. Посмотрим в общем.










































