Пройти тему
🤖 AI для жизни и работы · 🎨 Мультимодальный AI

Генерация изображений

DALL-E, Midjourney: создаём визуал

Введение

Текст — это только начало. Современный AI умеет создавать изображения по описанию: от фотореалистичных картин до абстрактного искусства. В этом уроке вы научитесь генерировать изображения для любых задач — от постов в соцсетях до иллюстраций для презентаций.

---

Инструменты генерации изображений

DALL-E 3 (OpenAI)

Доступ: Встроен в ChatGPT Plus Сайт: Через chat.openai.com

Плюсы:

  • Интеграция с ChatGPT — можно уточнять в диалоге
  • Хорошее понимание текстовых описаний
  • Генерирует текст на изображениях (относительно)
  • Безопасность — меньше нежелательного контента
Минусы:
  • Ограниченная стилизация
  • Не всегда «слушает» детали промпта
  • Платная подписка для полного доступа
Лучше всего для: Быстрые иллюстрации, продуктовые изображения, базовый контент

---

Midjourney

Доступ: Через Discord (discord.gg/midjourney) Сайт: midjourney.com

Плюсы:

  • Высочайшее художественное качество
  • Богатая стилизация
  • Сильное сообщество
  • Вариации и upscale
Минусы:
  • Только через Discord (непривычный интерфейс)
  • Платная подписка обязательна ($10-60/месяц)
  • Кривая обучения
Лучше всего для: Художественные изображения, концепт-арт, маркетинговые материалы высокого качества

---

Flux (Black Forest Labs)

Доступ: Различные сайты и приложения Примеры: fal.ai, replicate.com, и другие

Плюсы:

  • Быстрая генерация
  • Хорошее качество
  • Open-source версии
  • Гибкость настроек
Минусы:
  • Нет единого интерфейса
  • Требует выбора платформы
Лучше всего для: Технические задачи, интеграция в приложения

---

Kandinsky (Сбер)

Доступ: rudalle.ru, приложение Сбера

Плюсы:

  • Работает в России
  • Бесплатный базовый доступ
  • Понимает русский язык
Минусы:
  • Качество ниже лидеров
  • Меньше стилей
Лучше всего для: Быстрые задачи, когда нет доступа к зарубежным сервисам

---

---

@nanomug_bot (Telegram)

Доступ: Telegram — найдите [@nanomug_bot](https://t.me/nanomug_bot) Работает из России

Плюсы:

  • Работает прямо в Telegram — не нужны сайты и регистрации
  • Основан на топовых нейросетях (Flux, Stable Diffusion и др.)
  • Создаёт изображения по текстовому описанию
  • Редактирует фото по инструкции
  • AI Remix — объединяет 2–6 фотографий в одну композицию
  • Изменяет уже созданные изображения через Reply
Как использовать:

1. Создать изображение из текста Просто отправьте описание в чат бота. Пример: «нарисуй космический корабль в стиле киберпанк»

2. Отредактировать фото Отправьте фото + подпись с инструкцией. Пример: фото кота + «добавь шляпу» Для лучшего качества отправляйте как документ.

3. AI Remix из нескольких фото (2–6 штук) Отправьте несколько фото через галерею с подписью — бот объединит их в уникальную композицию. Можно ссылаться на конкретные фото тегами: img 0 img, img 1 img и т.д.

Примеры промптов для Remix:

  • «Объедини первое и второе фото в один пейзаж»
  • «Сделай первое фото в стиле второго»
  • «Добавь элементы из третьего фото на фон первого»
Важно: для Remix используйте обычную отправку фото, не как документы.

4. Изменить созданное изображение Ответьте (Reply) на картинку от бота с текстом изменений.

Лучше всего для: Быстрая генерация и редактирование изображений, прямо из Telegram

---

Сравнительная таблица

| Критерий | DALL-E 3 | Midjourney | Flux | Kandinsky | @nanomug_bot | |----------|----------|------------|------|-----------|--------------| | Качество | 4/5 | 5/5 | 4/5 | 3/5 | 4/5 | | Стилизация | 3/5 | 5/5 | 4/5 | 3/5 | 4/5 | | Простота | 5/5 | 3/5 | 3/5 | 5/5 | 5/5 | | Редактирование фото | Нет | Нет | Нет | Нет | Да | | Цена | $20/мес | $10-60/мес | Разная | Бесплатно | Бесплатно | | Работает в РФ | Нет | Нет | Частично | Да | Да |

---

Как писать промпты для изображений

Структура промпта

` [Основной объект], [действие/поза], [окружение/фон], [стиль], [освещение], [цветовая палитра], [настроение], [дополнительные детали] `

Ключевые элементы

1. Объект — кто или что изображено:

  • «Молодая женщина в деловом костюме»
  • «Чашка кофе на деревянном столе»
  • «Футуристический город»
2. Действие / поза:
  • «Смотрит в камеру, улыбается»
  • «С паром, утренний свет»
  • «Вид сверху, вечер»
3. Стиль:
  • photorealistic — фотореализм
  • digital art — цифровая графика
  • watercolor — акварель
  • minimalist — минимализм
  • 3D render — 3D-рендер
  • oil painting — масляная живопись
  • anime style — аниме
  • vintage photograph — ретро-фото
4. Освещение:
  • natural light — естественный свет
  • studio lighting — студийное
  • golden hour — золотой час
  • dramatic lighting — драматичное
  • soft diffused light — мягкое рассеянное
  • neon lights — неоновый
5. Цвета и настроение:
  • warm tones — тёплые тона
  • cool blues — холодные синие
  • vibrant colors — яркие цвета
  • muted palette — приглушённая палитра
  • moody atmosphere — атмосферный
  • cheerful and bright — весёлый и яркий
---

Примеры промптов

Для социальных сетей

Аватар для профиля: ` Portrait of a professional young man, confident smile, wearing casual smart clothes, soft natural lighting, clean background, photorealistic, high quality `

Баннер для канала: ` Abstract geometric background, gradient from purple to blue, modern minimalist style, tech aesthetic, wide format 16:9 `

Для бизнеса

Продуктовое фото: ` Minimalist product photography, white coffee cup, marble surface, soft shadows, clean white background, commercial photography style, high-end aesthetic `

Иллюстрация для статьи: ` Business team brainstorming, modern office space, diverse group of professionals, collaborative atmosphere, natural lighting through large windows, corporate style `

Для творчества

Концепт-арт: ` Futuristic cityscape at sunset, flying vehicles, neon lights reflecting on glass buildings, cyberpunk aesthetic, dramatic sky, cinematic composition `

Иллюстрация: ` Cozy autumn scene, person reading book by window, rain outside, warm indoor lighting, watercolor style, peaceful mood, soft muted colors `

---

Практические применения

Контент для социальных сетей

| Тип контента | Стиль промпта | |--------------|---------------| | Сторис | Яркий, минималистичный, вертикальный | | Пост | Привлекающий внимание, соответствующий бренду | | Обложка | Профессиональный, широкий формат | | Мем | Простой, с пространством для текста |

Маркетинговые материалы

  • Баннеры для рекламы
  • Иллюстрации для лендингов
  • Изображения для email-рассылок
  • Mockups продуктов

Презентации

  • Фоновые изображения для слайдов
  • Иллюстрации концепций
  • Диаграммы и визуализации
  • Иконки и элементы дизайна
---

Этика и авторские права

Что нужно знать

1. Права на изображения:

  • Большинство сервисов дают коммерческие права
  • Проверяйте Terms of Service конкретного сервиса
  • DALL-E / Midjourney обычно разрешают коммерческое использование
2. Что нельзя генерировать:
  • Реальных людей без разрешения (дипфейки)
  • Контент, нарушающий авторские права
  • Запрещённый контент
3. Этические моменты:
  • Маркировка AI-контента (становится требованием)
  • Прозрачность — не выдавать AI-арт за ручную работу
  • Уважение к художникам — не копировать стиль напрямую

C2PA и Watermarking

C2PA (Coalition for Content Provenance and Authenticity) — стандарт маркировки контента. Всё больше платформ требуют указывать, что контент создан AI.

---

Советы по улучшению результатов

1. Будьте конкретны

` ❌ «Красивый пейзаж» ✅ «Горное озеро на рассвете, туман над водой, сосновый лес, фотореалистичный стиль, золотистое освещение» `

2. Указывайте стиль

` ❌ «Портрет женщины» ✅ «Портрет женщины, studio photography, Rembrandt lighting, professional headshot, neutral background» `

3. Используйте референсы стилей

` «In the style of Studio Ghibli» «Reminiscent of Wes Anderson films» «Similar to Apple product photography» `

4. Итерируйте

  • Не получилось с первого раза — нормально
  • Добавляйте детали, убирайте лишнее
  • Пробуйте разные формулировки

5. Используйте негативные промпты

(В Midjourney и Stable Diffusion) ` --no text, watermark, blurry, low quality `

---

Практическое задание

> Инструменты для генерации изображений: DALL-E (через ChatGPT Plus), Midjourney, Kandinsky (Сбер). Из России: Telegram-бот [@nanomug_bot](https://t.me/nanomug_bot) — генерирует и редактирует изображения прямо в Telegram на топовых нейросетях. Помощь с промптами — [@gptmug_bot](https://t.me/gptmug_bot).

Цель

Создать 5 изображений для разных целей.

Задания

1. Аватар для профессионального профиля ` Создайте портретное изображение для профессионального профиля (hh.ru, Habr, Telegram). Стиль: профессиональный, но дружелюбный. `

2. Баннер для социальной сети ` Создайте баннер для Telegram-канала о [ваша тема]. Формат: широкий, с пространством для названия. `

3. Иллюстрация к статье ` Создайте изображение для статьи о [тема]. Стиль: соответствующий теме и аудитории. `

4. Карточка товара / услуги ` Создайте визуализацию для [товар/услуга]. Стиль: коммерческий, привлекательный. `

5. Креативное изображение ` Свободная тема — покажите возможности AI. Экспериментируйте со стилями. `

Результат

5 изображений + промпты, которые вы использовали.

---

Домашнее задание

Создайте визуальный контент для своего проекта:

  • Определите, какие изображения вам нужны
  • Напишите промпты
  • Сгенерируйте варианты
  • Выберите лучшие
  • Сохраните библиотеку промптов
  • ---

    Пройти эту тему с проверкой Разбор вопросов и зачёт — бесплатно, без регистрации

    Другие темы курса «AI для жизни и работы»

    Другие курсы