Как сделать картинку по описанию нейросетьюГенерация изображений нейросетью — большое руководство

Как сделать картинку по описанию

Самый быстрый способ понять генерацию изображений — сделать первую картинку прямо сейчас, а уже потом разбираться, как это работает. Так и поступим: к концу этой главы у вас будет готовое изображение и понимание, что делать дальше.

За одну минуту: первый результат

Любая нейросеть-художник работает по одной схеме: вы пишете текстом, что хотите увидеть, — она рисует. Это называют по-разному: «рисунок по тексту», text-to-image, генерация по описанию. Суть одна.

Попробуйте прямо здесь. Не усложняйте — для начала хватит одного предложения, например «уютная кофейня дождливым вечером, тёплый свет, акварель».

Уютная кофейня дождливым вечером, тёплый свет, акварель — изображение, сгенерированное нейросетью по описанию
Результат по тому самому промту: «уютная кофейня дождливым вечером, тёплый свет, акварель». Ниже попробуйте свой.
Загрузка…

Заметьте, что произошло. Вы не выбирали кисти, не искали референсы, не открывали Photoshop. Вы описали — и получили. Всё дальнейшее мастерство сводится к тому, чтобы описывать точнее.

Из чего состоит хорошее описание

Новички пишут «красивая девушка» и расстраиваются, что результат каждый раз разный. Опытные пользователи описывают картинку так, будто диктуют её человеку, который вас не видит и не угадывает. Полезно держать в голове четыре слоя:

  1. Объект — что или кто на картинке. «Рыжий кот».
  2. Действие и обстановка — что происходит и где. «…сидит на подоконнике, за окном ночной город».
  3. Стиль — фотография, акварель, 3D-рендер, аниме, масло. «…в стиле кадра из фильма».
  4. Детали кадра — свет, ракурс, настроение, цвета. «…мягкий тёплый свет, вид сбоку, уютно».

Сложите их вместе — и вместо лотереи получите управляемый результат. Этому полностью посвящена следующая глава, «Как писать промты»; пока достаточно понять принцип: чем конкретнее вход, тем предсказуемее выход.

Текст — не единственный вход

«Сделать картинку» не всегда значит «с нуля». Часто под рукой уже есть изображение, и нужно его изменить — это тоже генерация, просто отправной точкой служит не только текст:

  • По фотографии — загрузить своё фото и попросить изменить стиль, фон или одежду.
  • По наброску — нарисовать кривую схему от руки, нейросеть превратит её в чистую иллюстрацию.
  • По частям — выделить кусок готовой картинки и перерисовать только его (заменить небо, убрать лишний объект, поменять лицо).

Если ваша задача ближе к обработке готового фото, чем к рисованию с нуля, — вам в раздел про работу с фотографиями. Если хочется именно создавать — продолжаем.

Почему у двух людей выходит по-разному

Одно и то же описание в один и тот же сервис почти никогда не даёт идентичную картинку — и это не баг. Под капотом есть элемент случайности (его называют seed), плюс играет роль выбранная модель: одна тянет в фотореализм, другая — в рисунок. Поэтому первый результат стоит воспринимать как черновик: сгенерировали несколько вариантов, выбрали ближайший, уточнили описание, повторили. Две-три итерации — и картинка «дозревает».

Чек-лист «9 ошибок новичка, из-за которых картинка получается не такой»

Что убрать из промта, какие слова ломают результат и почему «4k, ultra detailed» чаще мешает, чем помогает.

Гость
2
Аккаунт
3
Подписка

Входит в подписку

Что дальше

Вы сделали первую картинку и поняли, что качество результата — это качество описания. Логичный следующий шаг — научиться описывать профессионально: какие слова работают, как задавать стиль и свет, как чинить типичные артефакты.

Частые вопросы

Как сделать картинку по описанию нейросетью?
Опишите текстом, что хотите увидеть, — нейросеть нарисует. Для начала хватит одного предложения, например «уютная кофейня дождливым вечером, тёплый свет, акварель». Попробовать можно прямо в этой главе или в чате Twelver: картинка приходит в ответ на обычное сообщение.
Как бесплатно сделать картинку по тексту?
Несколько генераций доступны бесплатно после регистрации в Twelver. Из российских сервисов бесплатно работают Шедеврум и Kandinsky. Подробнее о выборе модели — в главе «лучшие нейросети».
Из чего состоит хорошее описание для нейросети?
Из четырёх слоёв: объект (что или кто), действие и обстановка (что происходит и где), стиль (фото, акварель, 3D, аниме) и детали кадра (свет, ракурс, настроение). Чем конкретнее вход, тем предсказуемее выход. Подробно — в главе «как писать промты».
Почему по одному описанию каждый раз разная картинка?
Это не баг: под капотом есть элемент случайности (seed), плюс роль играет выбранная модель. Поэтому первый результат — черновик: сгенерируйте несколько вариантов, выберите ближайший, уточните описание и повторите. Две-три итерации обычно достаточно.

Все примеры можно повторить в чате Twelver: генерация встроена прямо в переписку — пишете как обычное сообщение, картинка приходит в ответ. Несколько генераций бесплатно после регистрации.

Попробуйте сами

Всё из этого руководства работает в Twelver

Один чат для текста, картинок, видео, музыки и озвучки — без отдельных сервисов и подписок.

Открыть чат Twelver
Оцените свой опыт