Привет. Меня зовут Андрей, я маркетолог и консультант, в профессии почти десять лет, за плечами профильное высшее и годы практической работы. За эти годы я перепробовал почти всё, что умеет рисовать по тексту, и потратил на подписки сумму, за которую можно было почиллить у океана с баром “все включено”. Этот обзор - выжимка из потраченных денег.
Сразу договоримся на «ты», так проще. И предупрежу: быстрых денег в AI нет. Если тебе кто-то обещает, что сегодня ты ткнёшь в генератор картинок, а завтра выстроится очередь клиентов, - это ложь чистой воды. Инструмент рабочий, деньги на нём делают, но руками и головой.
Как я вообще к этому пришёл и почему «кнопки бабло» тут нет
Я пришёл в тему не от хорошей жизни. Был у меня клиент - небольшой магазин на маркетплейсе, бюджет на фотосъёмку почти нулевой, а карточки надо чем-то наполнять. Первое, что я сделал, - полез в нейросеть для генерации изображений с мыслью «за вечер нащёлкаю сто картинок и месяц не буду батрачить». Было больно. Первые полсотни ушли в корзину, потому что у моделей то шесть пальцев на руке, то бутылка шампуня превращалась в нечто из фильма ужасов.
Вот тогда и дошла простая вещь. Генератор картинок по тексту - это как хороший фотоаппарат в руках новичка. Камера топовая, а снимки первое время кривые, пока не научишься. Деньги появляются, когда ты закрываешь чью-то боль: делаешь дизайнеру рутину быстрее, магазину - карточки дешевле, блогеру - обложки, на которые кликают. Нейросеть тут рычаг, тянуть за него всё равно тебе.
Midjourney - эталон по картинке
Если нужна просто красивая, «дорогая» картинка, Midjourney до сих пор держит планку. Я гнал его на обложки телеграм-каналов и арты инфопродуктов. Композиция, свет, фактура - тут ему мало кто дотягивается до пят.
Плюсы, минусы, цена, кому брать
Плюсы простые: картинка из коробки выглядит так, будто над ней сидел иллюстратор. Апскейл до высокого разрешения работает чисто, детали не разваливаются. Стиль держит, если подкинуть референс.
Минусы скажу честно. Русский текст на картинке он рисует отвратительно, кракозябры почти гарантированы, для надписей ищи другой инструмент. Работает через Discord и веб, новичка это первое время может пугать. Бесплатного тарифа нет, платить придётся сразу.
По цене начинается где-то от 10 долларов в месяц за минимальный тариф. Я сижу на среднем, мне хватает. Брать стоит если продаёшь визуал: обложки, арты, атмосферные иллюстрации. Держу подписку именно ради этого, они окупаются одним-двумя заказами в месяц.
DALL·E 3 внутри ChatGPT – если дружишь с текстом
DALL·E 3 живёт прямо в ChatGPT, и это главный козырь. Ты пишешь запрос человеческим языком, длинно, с деталями, а модель сама достраивает недосказанное. Меня это выручает, когда картинка сложная по смыслу: например, «уставший курьер сидит на ступеньках подъезда, вечер, дождь, в руках телефон с картой».
Midjourney на таком описании может уйти в красоту и потерять смысл. DALL·E чаще попадает в саму сцену. Русский текст рисует средне, короткие слова иногда выходят, но на длинные надписи я бы не рассчитывал.
Раз он внутри ChatGPT, ты можешь тут же попросить переписать промпт, поменять деталь, сделать десять вариаций одной фразой. Для новичка это мягкий вход. Идёт в подписке ChatGPT Plus, это примерно 20 баксов в месяц, туда же входит сам чат для работы с текстом. Если ты платишь за ChatGPT, генерация картинок достаётся фактически как бонус.
Stable Diffusion и Flux - бесплатно, но с нюансами
Вот и добрались до бесплатного генератора картинок в самом честном виде. Stable Diffusion можно поставить на компьютер и гонять локально, не платя ни копейки за генерации. Flux - более свежее семейство моделей, рисует заметно чище, особенно лица и руки, и его тоже можно крутить бесплатно через разные оболочки.
В чём подвох. Чтобы это заработало красиво, нужна видюха поприличнее и терпение на установку. Я первый вечер на настройку, ловил ошибки, качал модели по несколько гигов. Потом окупилось: за локальную генерацию платить не нужно, контроля там сколько угодно. Тут тебе и txt2img (картинка по тексту), и img2img (переделка готовой картинки по образцу), и тонкая настройка стилей.
Если мощной видеокарты нет, есть облачные сервисы, где эти модели крутятся за небольшие деньги по кредитам. Подойдёт тем, кто готов немного повозиться и хочет полный контроль без ежемесячной подписки. Кому важно нажал-получил, лучше начать с чего попроще.
Leonardo AI, Ideogram, Recraft - рабочие лошадки под конкретику
Эта тройка у меня в закладках как «инструменты под задачу». Красотой ради красоты они не всегда блещут, зато решают конкретные боли.
Leonardo AI я использую, когда надо много однотипных картинок для соцсетей: ставишь стиль, референс, и штампуешь серию в одном ключе. Есть бесплатный лимит по кредитам в день, для пробы хватает. Платный тариф стартует где-то от 10 долларов.
Recraft - моя палочка-выручалочка для логотипов и векторной графики. Он отдаёт картинку в векторе, и логотип потом можно спокойно масштабировать хоть на баннер, хоть на визитку без потери качества. Для брендинга дорогого стоит.
Кто рисует читаемый текст на картинке без кракозябр
Отдельная боль новичка - надпись на картинке. Большинство моделей русский текст превращают в набор символов. Из тех, что я гонял, лучше всех держат текст Ideogram и Recraft. Первый я брал, когда нужно было сделать обложку с чёткой короткой фразой, и он мне выдал читаемую надпись со второй попытки. Recraft вытягивает текст в связке с логотипами. У обоих есть бесплатный уровень, проверь их на своей фразе, прежде чем платить. Kandinsky и Шедеврум с русским текстом справляются терпимо для коротких слов, но чуда ждать я бы не стал.
Российские нейросети - Kandinsky (Сбер) и Шедеврум (Яндекс)
Про отечественные модели говорят редко, а зря. Kandinsky от Сбера и Шедеврум от Яндекса бесплатны, работают без танцев с оплатой зарубежных карт и заточены под русский запрос. Для новичка нейросеть рисует картинки по описанию без единой копейки вложений, отличная точка входа.
Kandinsky я гонял на быстрых иллюстрациях для статей и картинках для постов. По глянцу он до Midjourney конечно не дотянет, но для контента в блоге хватает за глаза. Шедеврум удобно живёт в приложении на телефоне, там же лента чужих работ, где можно подсмотреть удачный промпт. Аватарки и картинки для сторис я делал прямо с телефона в очереди в поликлинике.
Минус честный: сложные сцены и тонкий стиль они тянут хуже западных. Но как бесплатный старт без оплаты зарубежных подписок – пойдет .
Как писать промпт, чтобы картинка вышла с первого-второго раза
Промпт - это твой запрос к модели, и от него зависит почти всё. Новички пишут «красивая девушка в городе» и удивляются, почему выходит скучно. Модель не понимает, чего ты хочешь, и додумывает за тебя.
Я держу в голове простую схему: кто или что в кадре, что делает, где, какой свет и время суток, стиль, качество. Чем конкретнее, тем меньше мусора на выходе.
Разбор промпта на живом примере
Возьмём реальную задачу - обложка для статьи про подработку курьером. Плохой вариант: «курьер с едой». Что выдаст модель, предугадать невозможно.
Теперь как писать надо : «молодой курьер в жёлтой куртке с квадратной сумкой за спиной идёт по вечерней улице, тёплый свет фонарей, лёгкий дождь на асфальте, реалистичная фотография, высокое разрешение». Разница на выходе огромна. Дальше беру удачный кадр, отправляю его в img2img как референс и прошу «то же самое, но сумка синяя». Так за две-три итерации добираю нужное, вместо того чтобы крутить рулетку по сто раз. И с нервами все хорошо и время есть куда потратить. Не нужно сидеть часами и рвать волосы на голове из-за постоянных доработок.
Ещё мелочь, которая экономит кредиты. Не проси сразу максимальное разрешение, сначала найди удачную композицию на черновом качестве, а апскейл дави под финал.
Можно ли продавать картинки из нейросети
Вопрос, на котором многие спотыкаются. Коротко: продавать чаще всего можно, но читай лицензию конкретного сервиса, условия у всех разные и меняются.
Midjourney на платных тарифах разрешает коммерческое использование. У DALL·E через ChatGPT права на созданное отдаются тебе, коммерция допускается. Stable Diffusion и Flux в основном позволяют коммерческое применение, но конкретная модель или дополнение могут накладывать свои ограничения, проверяй каждую. У бесплатных тарифов часто вылезает водяной знак или запрет на коммерцию, это нормальная плата за нулевую цену. Ещё момент про товарку для маркетплейсов и логотипы. Логотип, целиком сгенерированный нейросетью, в ряде стран сложно зарегистрировать как товарный знак, с авторством у машинной генерации всё муторно. Контенту это не мешает. Если строишь бренд всерьёз, дизайнер-человек на финальную доводку всё же понадобится. Я обычно генерю концепт нейросетью, потом отдаю живому дизайнеру на вычистку.
Частые ошибки новичков
Пройдусь по граблям, на которые сам наступал и вижу у клиентов постоянно.
Первая - ждать шедевр с первой попытки. Нормальный результат приходит за несколько итераций, заложи на это время и кредиты.
Вторая - платить за всё сразу, не пощупав бесплатное. Начни с Kandinsky, Шедеврума и бесплатных лимитов, а деньги неси туда, где упёрся в потолок.
Третья - лить генерации без задачи. Красивая картинка в стол денег не приносит. Да конечно можно сделать свое фото в старорусском стиле и показывать коллегам на работе предлагая также за копейку, но я бы подумал)
Четвёртая - игнорировать текст на картинке и потом удивляться кракозябрам. Нужна надпись - сразу бери Ideogram или Recraft. Пятая - забивать на лицензию и продавать то, что нельзя. Один раз я чуть не отдал клиенту пачку картинок с бесплатного тарифа, где стоял запрет на коммерцию, вовремя перечитал условия. Возможно бы и пронесло, но если бы не пронесло было бы худо.
А теперь про деньги, это самое живое. Проблема простая: Midjourney хочет свою подписку, ChatGPT свою, Leonardo свою, и вот ты уже отдаёшь под сотню долларов в месяц за инструменты, половину из которых открываешь раз в неделю. Я так и попал в первый год, платил за четыре сервиса и толком пользовался двумя.
Дам личный лайфхак, к которому пришёл сам. Когда мне лень заходить в три-четыре разных сервиса и платить каждому отдельно, я гоняю разные модели через SYNTX - там из одного окна дёргаешь сразу несколько нейросетей, включая генерацию картинок, и платишь по факту за то, что нагенерил, а не за пять подписок скопом. Мне это удобно, когда надо быстро проверить идею в паре моделей и выбрать, где картинка легла лучше. Для новичка это ещё и способ пощупать разные генераторы разом.
Второй способ сэкономить - не держать все подписки разом. Я оформляю Midjourney на месяц, когда идёт поток обложек, а в спокойный отключаю и сижу на бесплатных Kandinsky и Flux. Подписки спокойно ставятся на паузу.
С чего начать конкретно:
Давай без философии, по шагам, чтобы к выходным у тебя был результат.
В первый день заведи Kandinsky или Шедеврум и нагенери двадцать картинок на любую тему, набей руку на промптах. На второй-третий день возьми одну реальную задачу: обложку для поста, аватарку, картинку для объявления - и доведи её до приличного вида за несколько итераций. К концу недели у тебя на руках десяток нормальных картинок, понимание, какая модель под что заточена, и ноль потраченных зря денег. С этого уже можно предлагать услугу знакомым или закрывать свою задачу без дизайнера. Кнопки бабло так и не появится, врать не буду, но рабочий навык, за который платят, - вполне.