Пятая генерация — и снова мимо
Знаете, что в картиночных нейросетях выматывает сильнее всего? Совсем не то, что они рисуют плохо. А то, что они рисуют почти.
Свет тот. Настроение то. Кружка на столе ровно та, которую вы и представляли. Только у героини на руке лишний палец, а вывеска за её спиной — на языке, которого не существует.
Жмём «сгенерировать ещё раз» — и получаем другую картинку. Не исправленную. Другую. И так по кругу, пока не махнём рукой: «ладно, пойдёт и эта». Бесит же, согласитесь? 🙄
И я тут не наблюдатель: круги по «ещё раз» наматываю вместе с вами.
Вот ровно в это место и целится свежая новость.
xAI выпустила Imagine Image 2.0 — обновление своего генератора изображений. И подают его не как «ещё одну красивую генерацию», а как инструмент для реальной итеративной работы с картинками.
Коротко, без пресс-релиза. Ставка не на «сгенерировал и смирился», а на «сгенерировал и довёл до нужного». Не выдал и забыл — а правки. Те самые, ради которых раньше искали человека с Photoshop.
Ручаться за инструмент не буду: пощупаю в работе — тогда и расскажу. Но сама ставка показательная. Мучаемся-то мы не на первой генерации. Мы мучаемся на доводке.
И тут же встаёт вопрос-убийца, из-за которого учёбу откладывают на «как-нибудь потом»:
«Если машина теперь и рисует, и правит — за что вообще платить человеку? Скоро же всякий сможет.»
Отвечаю без утешений.
Инструмент дешевеет — человек дорожает. Те же самые нейросети доступны вашему клиенту ровно так же, как вам. Никто не мешает ему сесть вечером и довести картинку самому. Он этого не делает: он не знает, что именно менять, и не готов отдавать этому вечер. Платят не за доступ к кнопке — платят тому, кто доводит до результата. 💯
А доводка — это, между прочим, готовая услуга. Пока нейросеть умела только «выдать», продавать было особо нечего: выдала и выдала. Как только инструмент затачивают под правки, появляется работа с понятным названием — довести визуал под бренд клиента: его цвета, его лицо, его интонацию. Не «нажать кнопку», а отдельный навык, за который берут отдельные деньги.
Три правила, которые я держу в голове, когда правлю картинку словами. Это моё личное, а не инструкция xAI:
💥 Одна правка за раз. Скажете машине сразу три — не поймёте, какая сработала, а какая всё сломала.
🤔 Формулируйте предметно. «Сделай лучше» не понимает никто, включая живого дизайнера. «Убери вторую чашку, свет не трогай» — понимают все.
✔️ Список «не менять» — заранее. Лицо, фирменный цвет, ракурс. Иначе к пятой итерации у вас будет отличная картинка. Чужая.
А вы на какой попытке миритесь с «почти»? На третьей? На десятой? Пишите 👇
Кстати, доводка до «то самое» — это и есть та работа, за которую платят. С неё и начинаем на бесплатном практикуме: на своих задачах, а не на теории.