Сравнивать генераторы картинок по чужим демо бесполезно: у всех красивые витрины. Мы взяли одно ТЗ и прогнали его в нескольких сервисах, которые реально открываются для повседневной работы. Цель не найти «лучшую нейросеть искусства», а понять, кто быстрее даёт кадр, пригодный для поста или обложки.
ТЗ было коротким: рабочий стол сверху, ноутбук, блокнот, дневной свет, спокойные цвета, без людей, без логотипов, без водяных знаков. Отдельно попросили не писать на картинке английские слова. Если сервис умеет текст в кадре, пусть лучше обойдётся без него.
Критерии простые и жёсткие. Соответствие брифу: стол, свет, отсутствие лиц. Чистота кадра: артефакты, кривые пальцы тут не про людей, но «плывущие» предметы и странные тени тоже считаются. Пригодность: можно ли поставить в статью после минимальной обрезки. Отдельно смотрели, не пролез ли английский текст на стикерах и экране.
Один сервис лучше держал композицию и свет, но иногда добавлял лишние объекты «для красоты». Другой точнее слушал запреты из ТЗ, зато кадр выходил площе. Третий давал эффектную картинку, которая слабо совпадала с заданием: красиво, но мимо брифа. Для контента сайта «мимо» почти всегда хуже, чем скромный, но точный кадр.
Для обложек статей и постов важнее дисциплина промпта, чем охота за названием модели. Пишите сцену, свет, ракурс и запреты явно. Делайте 2–3 генерации в двух сервисах, а не двадцать в одном. Выбирайте кадр, который ближе к задаче, а не тот, что больше похож на конкурсную картину.
Если в кадре нужен русский текст (цена, заголовок, кнопка), проверяйте его отдельно: генераторы до сих пор часто ломают буквы. Иногда проще собрать фон нейросетью и наложить надпись руками в редакторе. Для сайта это обычно быстрее и чище.
Повторяемость эксперимента полезна раз в квартал: модели меняются, лимиты тоже. Сохраните своё ТЗ и таблицу критериев. Тогда через месяц вы сравниваете не ощущения, а одинаковый тест.